近日,有开发者利用普通高中生物教科书中的“食物网”图示对主流多模态大模型(LLM)进行了测试。结果显示,即便是 GPT 和 Gemini 等顶尖模型,在面对复杂的网状结构和交叉箭头时也纷纷“翻车”,未能正确统计出19条食物链。相比之下,人类通过梳理逻辑轻松解决了问题。这一实验揭示了现有多模态 AI 在处理复杂拓扑关系和空间逻辑推理时的脆弱性,表明当前的视觉理解能力虽有进步,但在复杂图表分析上仍有明显局限。
多模态大模型遭遇“滑铁卢”:GPT与Gemini竟数不清教科书里的食物链
未经允许不得转载:80aj » 多模态大模型遭遇“滑铁卢”:GPT与Gemini竟数不清教科书里的食物链
相关推荐
1M 上下文已经可用: Claude、Gemini 与编程 Agent 怎么选
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
Google I/O 2026 的真正主线:不是模型大战,而是 Google 把 Gemini 变成生态内核
谷歌要求学生用户重新验证身份以保留 Gemini 等额度的福利资格
弃用Gemini?开发者热议:为何谷歌全家桶还是赢不了GPT
对标 Gamma!开源 AI PPT 工具 LandPPT 发布,支持多模型接入
谷歌严查Gemini学生福利,大量违规账户面临封禁风险
开发者实测 Gemini 3.1 Pro 严重“降智”,模型稳定性再引质疑