技术社区 Linux.do 近期发起了一项关于 xAI 最新模型 Grok 4.5 性能表现的统计讨论,主题直指模型是否存在“降智”现象。随着 Grok 模型被广泛应用于各类开发工具,部分开发者反馈其在处理复杂任务时出现了能力倒退或逻辑混乱的情况。此次统计旨在收集不同渠道下的用户体验差异,具体涵盖了免费版 Grok、Supergrok 标准版、Supergrok 高级版、集成在编程工具 Cursor 中的版本,以及直接调用 xAI API 的接口。社区试图通过大量样本数据,分析是否存在特定触发词或特定路由导致了模型表现不稳定。这一讨论不仅关乎单一模型的口碑,更折射出业界对于大模型在实际应用场景中一致性与可靠性的普遍焦虑。
事件分析
💡 核心观点:模型性能的“降智”争议警示行业,AI落地不仅要拼参数规模,更要解决多路由环境下的一致性与抗崩溃难题。
原文链接:Linux.do





