云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本

DeepSeek V4 Flash 发布搅动 AI 市场:极低定价逼得 OpenAI 与智谱纷纷应战

云聚 AI Token Plan 满 199 减 35 元

7 月 31 日,DeepSeek 正式发布 V4 Flash 模型,该模型拥有约 284B 参数,重点强化了 Agent、代码生成及工具调用能力。其 API 定价极具攻击性,输入价格为 1 元/百万 Token,输出为 2 元/百万 Token,且支持高达 99% 的缓存命中率,实际使用成本极低,性能上足以与参数规模更大的模型(如 GLM 5.2)竞争。几乎同一时间,智谱 AI(GLM)将订阅模式从“按请求次数计费”调整为“按实际 Token 计费”,导致用户实际使用成本上涨,引发社区争议。OpenAI 也在 7 月 30 日宣布下调 GPT-5.6 Luna 的价格,降幅达 80%,但在 DeepSeek 的超低价面前优势仅维持了数小时。此外,开发工具 TRAE 中国版宣布改为积分制,标志着 AI 领域“无限畅用”时代的终结。这一系列事件表明,大模型厂商正围绕“推理成本”和“性价比”展开激烈的存量竞争。

事件分析

这一波价格战的本质是 AI 推理技术边际成本下降的体现。OpenAI 提及的 GPU 内核优化和推测解码技术,意味着行业正在从单纯的堆算力转向追求算法和架构的极限效率。DeepSeek V4 Flash 以 284B 参数挑战 700B+ 级别的模型,证明了“小参数高性能”的路线在特定场景下的可行性,这对盲目追求参数规模的行业风气是一次纠偏。厂商从按次付费转向按 Token 计费,反映了 AI 应用场景正从简单聊天转向复杂的 Agent 和代码生成,单一请求的资源消耗差异巨大,精细化的计费模式是商业可持续的必经之路。市场格局正在重塑,多模态能力将成为厂商抵御纯文本价格战的重要护城河。

💡 核心观点:DeepSeek 以极致性价比打破行业溢价泡沫,迫使大模型竞争从“参数军备竞赛”转向“推理效率与成本控制”的硬实力比拼。

阿里云 OPC 一人公司创业装备库

原文链接:Linux.do

阿里云函数计算 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » DeepSeek V4 Flash 发布搅动 AI 市场:极低定价逼得 OpenAI 与智谱纷纷应战
赞助推荐 FreeModel.dev Claude Code 中转
阿里云函数计算 一键部署 AI 大模型