Opus 4.7 惨遭差评:被指滥用合成数据致模型退化,'Anthropic基因'消失
Anthropic 最新模型 Opus 4.7 在社交媒体和技术论坛引发强烈不满。用户批评该版本充斥合成数据与蒸馏训练痕迹,不仅失去了原有的 Anthropic 特性,甚至在逻辑处理和代码生成上出现严重倒退,被指“不说人话”、“蠢得一塌糊涂...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
Anthropic 最新模型 Opus 4.7 在社交媒体和技术论坛引发强烈不满。用户批评该版本充斥合成数据与蒸馏训练痕迹,不仅失去了原有的 Anthropic 特性,甚至在逻辑处理和代码生成上出现严重倒退,被指“不说人话”、“蠢得一塌糊涂...
近日,一位重度开发者基于数千个Claude Code会话日志进行了量化分析,指出该模型近期性能出现显著退化。分析表明,Claude已从早期的“研究优先”策略退化为“编辑优先”,在处理复杂工程任务时表现出明显的偷懒和草率,其深度思考能力据称下...
根据 Marginlab.ai 针对 SWE-Bench-Pro 的性能追踪数据,Anthropic 旗舰模型 Claude Opus 在过去 30 天内出现了统计显著的性能退化。数据显示其代码生成与解决复杂问题的能力有所下滑。这一现象引发...