一位资深用户在对比测试中指出,DeepSeek V4 在面对无标准答案、约束条件复杂且隐蔽的开放性问题时,依然无法达到 Claude Opus 4.5/4.6 的水平。用户举例称,Opus 一轮即可解决的难题,DeepSeek 经七轮纠错花费 1 美元仍未解决。该用户推测,这可能是混合专家模型无法像稠密模型那样全面激活所需专家,导致其在主动探索边缘条件和深度思考上存在先天不足,且其思考时长(约 20 秒)也远不及 Opus。
DeepSeek V4 遭用户吐槽:处理复杂推理时仍显乏力,MoE 架构或是瓶颈?
未经允许不得转载:80aj » DeepSeek V4 遭用户吐槽:处理复杂推理时仍显乏力,MoE 架构或是瓶颈?
相关推荐
John Ousterhout:TCP 和 RDMA 正拖慢 AI 推理,他想用 Homa 换掉它们
成本骤降70%!DeepSeek V4 Pro与Flash模型实战搭配指南
Claude Opus 闹乌龙:直接照搬 Codex 输出,AI“偷懒”现象引担忧
实测解锁 Cursor 调用 Opus 4.7 XHigh 模型:教育版与付费版操作指南
Anthropic 严打账号滥用:多名 Opus 用户因使用“全局”工具遭封禁
DeepSeek V4 适配进展:Axonhub 率先支持推理内容协议转换
揭秘Gemini "DeepThink":利用DeepSeek反向套取出的系统提示词全解析
开发者实测:DeepSeek V4 更适合“末尾注入”系统指令,显著提升 Agent 服从性