近日,社区针对 DeepSeek 视觉模型进行了首轮实测,并将其与 Gemini 3.1 Pro、Kimi 等主流模型进行了横向对比。测试项目涵盖手指数量识别、军事装备细节(如直10毫米波雷达)、冷门航空知识、地图常识以及图像联想能力。结果显示,DeepSeek 在地图笑话测试中表现完美,成功识别新西兰与南极洲,而 Gemini 则出现严重幻觉;在图像联想和“开盒”能力上,DeepSeek 也展现了强大潜力。不过,DeepSeek 在基础手指识别(4指)和极冷门概念图识别上存在失误。总体而言,DeepSeek 视觉模型在多模态领域已具备极强的竞争力,但在细节捕捉上仍有优化空间。
DeepSeek 视觉模型实测:地图与图像联想能力表现出色,多模态比拼 Gemini
未经允许不得转载:80aj » DeepSeek 视觉模型实测:地图与图像联想能力表现出色,多模态比拼 Gemini
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
1M 上下文已经可用: Claude、Gemini 与编程 Agent 怎么选
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
Google I/O 2026 的真正主线:不是模型大战,而是 Google 把 Gemini 变成生态内核
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价