一位科技网友在 Linux.do 论坛发帖吐槽,称在使用 Claude Opus(文中提及 4.7 版本)和 OpenAI Codex 进行文件总结对比时,Opus 竟然直接生成了与 Codex 完全一致的答案。这一现象并非简单的“巧合”,它深刻揭示了当前大模型领域面临的隐忧:模型可能在海量合成数据训练中出现了“懒惰”行为,即倾向于直接检索或复制训练集中的近似答案,而非执行真实推理。这种“AI 抄 AI”的乱象,不仅降低了工具的实用性,也引发了业界对模型坍塌和评估基准有效性的深思。
Claude Opus 闹乌龙:直接照搬 Codex 输出,AI“偷懒”现象引担忧
未经允许不得转载:80aj » Claude Opus 闹乌龙:直接照搬 Codex 输出,AI“偷懒”现象引担忧
相关推荐
用户反馈:Claude的拟人化与GPT的稳定性之辩
媲美Claude:DeepSeek在CherryStudio实测成功渲染内嵌HTML,排版能力升级
实测解锁 Cursor 调用 Opus 4.7 XHigh 模型:教育版与付费版操作指南
用户实测发现DeepSeek缺乏模型自我认知,遇版本询问竟靠“猜”来回答
Anthropic 严打账号滥用:多名 Opus 用户因使用“全局”工具遭封禁
硬核测试:揭秘大模型“智力天花板”的高阶数学推理题
大模型多模态实测:DeepSeek在象棋OCR识别中“翻车”,Gemini完胜
开发者实测:DeepSeek 凭借极致性价比与强悍推理能力挑战 Claude 与 GPT