近日,科技社区 Linux.do 引发热议,焦点在于国产大模型厂商智谱AI(Zhipu AI)与 DeepSeek 之间的定价竞争。据社区用户测算,智谱最新发布的 GLM-5.3-Flash 模型在特定高负载场景下的使用成本极具竞争力。具体数据显示,在每日处理 1 亿 Token、输入占比 90%、输出占比 10% 且输入部分 95% 命中缓存的典型开发场景下,模型调用费用约为每天 25 元人民币。这一价格甚至低于 DeepSeek 竞品在近期涨价前的水平。DeepSeek 此前凭借极具侵略性的定价策略重塑了市场预期,而智谱此次在 Flash 系列上的价格调整被视为强有力的回应。这一现象表明,国内头部大模型厂商在推理侧的成本控制已进入“肉搏战”阶段,高性能模型的边际成本正在迅速下降。
事件分析
此次事件折射出国内大模型商业化路径的显著转变,即从追求单纯的技术参数指标转向极致的性价比竞争。智谱与 DeepSeek 的对标表明,通过优化架构和 KV Cache 缓存机制来降低推理成本已成为技术关键。95% 的缓存命中率意味着厂商在处理高重复度输入(如上下文记忆、文档库检索)时实现了极高的压缩效率,这对 AI 应用落地至关重要。随着 API 价格不断探底,大模型厂商的策略正在从出售“Token”转向构建生态粘性,试图通过低价吸引开发者入驻,从而锁定未来的应用层流量。对于开发者而言,基础设施成本的降低将直接利好 AI 原生应用的爆发。
核心观点:大模型API价格击穿底部标志着“算力红利”正全面转化为“应用红利”,基础设施层的免费或低价策略将倒逼商业模式向应用服务层转移。
原文链接:Linux.do