7 月 31 日,DeepSeek 正式发布 V4 Flash 模型,该模型拥有约 284B 参数,重点强化了 Agent、代码生成及工具调用能力。其 API 定价极具攻击性,输入价格为 1 元/百万 Token,输出为 2 元/百万 Token,且支持高达 99% 的缓存命中率,实际使用成本极低,性能上足以与参数规模更大的模型(如 GLM 5.2)竞争。几乎同一时间,智谱 AI(GLM)将订阅模式从“按请求次数计费”调整为“按实际 Token 计费”,导致用户实际使用成本上涨,引发社区争议。OpenAI 也在 7 月 30 日宣布下调 GPT-5.6 Luna 的价格,降幅达 80%,但在 DeepSeek 的超低价面前优势仅维持了数小时。此外,开发工具 TRAE 中国版宣布改为积分制,标志着 AI 领域“无限畅用”时代的终结。这一系列事件表明,大模型厂商正围绕“推理成本”和“性价比”展开激烈的存量竞争。
事件分析
💡 核心观点:DeepSeek 以极致性价比打破行业溢价泡沫,迫使大模型竞争从“参数军备竞赛”转向“推理效率与成本控制”的硬实力比拼。
原文链接:Linux.do





