作者在Linux.do论坛分享了对GPT-5.2的失望评测,认为它是GPT-5系列中最失败的版本。SimpleQA成绩显示其表现极差,甚至不如o3和o1模型。GPT-5.2在回答L站问题时出错,参数未增加但价格上涨40%。相比之下,DeepSeek用2000张H800算力成功构建670B参数模型,被视为行业奇迹。作者还提出了三大厂参数分档:Gemini 3 Pro领先,GPT 4.5次之,Gemini 2.5第三。文章强调AI作为全能助手的重要性,包括Agent能力,反映了当前AI模型的竞争格局和用户需求。
GPT-5.2评测:失望之作,DeepSeek崛起
未经允许不得转载:80aj » GPT-5.2评测:失望之作,DeepSeek崛起
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
Howie Liu 讲的是雇一个 agent 当员工
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
给 AI 设一个美联储
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价