根据 Marginlab.ai 针对 SWE-Bench-Pro 的性能追踪数据,Anthropic 旗舰模型 Claude Opus 在过去 30 天内出现了统计显著的性能退化。数据显示其代码生成与解决复杂问题的能力有所下滑。这一现象引发了社区广泛讨论,甚至有用户指出,近期切换至国产模型 Kimi 时体验差异缩小,侧面印证了头部大模型“智商”不稳定的问题,引发行业对模型退化及护城河缩水的担忧。
监测数据显示 Claude Opus 近期智力显著退化,编程能力大幅下滑
未经允许不得转载:80aj » 监测数据显示 Claude Opus 近期智力显著退化,编程能力大幅下滑
相关推荐
对抗 OpenAI Codex 的效率攻势,Anthropic 宣布将 Claude Code 限额提升 50%
面对用户流失危机,Claude 推出激进补偿策略挽留开发者
Claude Opus 闹乌龙:直接照搬 Codex 输出,AI“偷懒”现象引担忧
OpenAI攻势猛烈?Anthropic悄然上调Claude额度,大模型竞争白热化
实测解锁 Cursor 调用 Opus 4.7 XHigh 模型:教育版与付费版操作指南
Anthropic 严打账号滥用:多名 Opus 用户因使用“全局”工具遭封禁
解决 Claude Opus 报错:手动重登比使用账号管理工具更有效
GPT新版本发布引连锁反应:Claude紧急修复“降智”,Gemini体验回升