跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
前沿哨所

ChatGPT 5.4 Thinking 逻辑翻车:一道“运煤题”难倒最强推理模型,Gemini却轻松过关

1 分钟阅读阅读(122)
赞助推荐 团队协作里的 AI 办公工作台

社区讨论显示,OpenAI最新的ChatGPT 5.4 Thinking模型在一道经典的“运煤逻辑题”面前再次栽跟头。题目要求区分“总量的4/7”与“4/7吨”的数量关系,正确答案应为“无法判断”,但ChatGPT未能识破其中的单位陷阱。相比之下,谷歌Gemini 3.1 Pro在离线状态下却给出了正确解答。这一对比不仅暴露了顶尖AI在基础逻辑推理上的不稳定性,也引发了业界对于大模型真实“智商”与常识理解能力的质疑。

原文链接:Linux.do

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » ChatGPT 5.4 Thinking 逻辑翻车:一道“运煤题”难倒最强推理模型,Gemini却轻松过关
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型