揭秘 AI 模型的“暗中削弱”:一张图看懂大模型性能退化史
随着大模型频繁更新,用户常怀疑模型变“笨”或受到更多限制。该项目通过可视化图表记录了各大 AI 模型的 ELO 评分历史,旨在揭露潜在的“暗中削弱”现象。文章指出,模型更新可能引入过度审查、过度量化以节省算力或行为退化。此外,项目还区分了 ...
标签索引
这个标签下有 4 篇文章。按时间回看相关判断与实践记录。
标签精选
随着大模型频繁更新,用户常怀疑模型变“笨”或受到更多限制。该项目通过可视化图表记录了各大 AI 模型的 ELO 评分历史,旨在揭露潜在的“暗中削弱”现象。文章指出,模型更新可能引入过度审查、过度量化以节省算力或行为退化。此外,项目还区分了 ...
近期,V2EX 社区出现大量关于 Claude Opus 模型“智力下降”的讨论。多位资深用户反馈,原本表现出色的模型在处理简单问题时频发“幻觉”,逻辑混乱,甚至出现“对喷”现象,体验远不如从前。这种“变笨”趋势引发了用户的普遍焦虑,有人怀...
近日,科技社区 Linux.do 引发热议,大量用户反馈 Claude 旗舰模型 Opus 4.7 出现严重性能退化。据多位用户实测,该版本模型不仅交互智商下降,连最核心的“Web fetch”(联网抓取)功能也已无法正常使用。这一现象引发...
近日,科技社区出现大量关于 Claude AI 模型 Opus 4.6 性能显著下降的反馈。多位用户报告称,该模型在处理常规问题时频繁出错,逻辑推理与代码定位能力大幅减弱,甚至出现无法完成简单任务的“降智”现象。这一反常表现引发了业界对大模...