跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
前沿哨所

智谱开源GLM-5.3-Flash:320B参数性能比肩Claude Opus,定价仅为后者1/40

3 分钟阅读阅读()
赞助推荐 团队协作里的 AI 办公工作台

智谱AI正式上线并开源GLM-5.3-Flash (320B-A18B) 原生多模态模型。该模型总参数量为320B(3200亿),但激活参数仅为18B(180亿),采用全新的稀疏注意力与线性注意力混合架构。在正式发布前,该模型以代号“Ox-Alpha”在OpenCode和OpenRouter进行测试,凭借国产芯片提供的算力支持,迅速成为双平台调用量最高的模型。性能方面,GLM-5.3-Flash在全球权威的Artificial Analysis Intelligence Index中获得57分,进入全球前沿模型能力区间,与Anthropic的Claude Opus 4.8持平;在编程基准测试中表现亦与Opus 4.8相当。该模型定价极具竞争力,标准价格为GLM-5.3的1/10,限时折扣期间仅为GLM-5.3的1/20,即Claude Opus 4.8价格的1/40。官方数据显示,其架构通过减少层数和激活参数(32B降至18B),结合30T Token的多模态预训练语料,在各项基准测试中全面超越参数量高出一倍的GLM-5.2。GLM-5.3-Flash原生融合视觉能力至Coding循环,支持前端开发、Blender 3D构建及真实环境交互操作;同时拓展至Office、金融等专业文档场景,具备自主拆解目标、调用工具及交付成品的完整工作流能力。目前已接入ZCode等平台,开放API调用并纳入GLM Coding Plan。

事件分析

GLM-5.3-Flash的发布展示了国产大模型在架构设计与工程化落地上的成熟度。通过引入流形约束超连接(mHC)及混合注意力机制,该模型在保持高性能的同时大幅降低了激活参数量和推理成本,这种“MoE+稀疏化”的技术路线正成为行业追求性价比的主流选择。在产业层面,其性能直接对标Anthropic最顶级的Claude Opus 4.8,且定价策略激进(仅为竞品1/40),这将对全球API市场的定价体系产生冲击。特别值得关注的是,该模型强调算力由国产芯片支撑,不仅验证了国产软硬件栈的兼容性,也为构建非美系AI算力生态提供了重要范例。此外,模型原生将视觉融入编码循环并强化Agent工作流能力,表明竞争焦点已从单一的文本生成转向多模态协同的任务解决能力。

核心观点:智谱通过架构创新与国产算力协同,实现了“模型性能比肩SOTA、推理成本大幅降低”的突破,加速了开源大模型在复杂Agent场景的落地。

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库

原文链接:Linux.do

赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 智谱开源GLM-5.3-Flash:320B参数性能比肩Claude Opus,定价仅为后者1/40
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型