跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
前沿哨所

大模型多模态实测:DeepSeek在象棋OCR识别中“翻车”,Gemini完胜

1 分钟阅读阅读(125)
赞助推荐 团队协作里的 AI 办公工作台

一项针对中国象棋场景的OCR对比测试显示,多模态大模型在特定领域的表现参差不齐。测试要求模型识别棋盘截图并转换为标准UCCI/FEN格式。结果显示,Google Gemini是唯一完全正确的模型;GPT系列出现了部分颜色识别错误;而近期备受瞩目的DeepSeek模型表现极差,在棋子位置、颜色及意图理解上全面失误。这一实测结果为市场泼了一盆冷水,表明尽管DeepSeek在代码与逻辑推理上表现出色,但在细粒度的多模态视觉理解方面,与顶尖水平仍存在明显差距。

原文链接:Linux.do

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 大模型多模态实测:DeepSeek在象棋OCR识别中“翻车”,Gemini完胜
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型