跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
前沿哨所

阿里云发布灵骏真武 M890 超节点:国内首个支持十万亿参数大模型推理

2 分钟阅读阅读(8)
赞助推荐 团队协作里的 AI 办公工作台

阿里云正式上线灵骏真武 M890 超节点实例,这是国内首个成功运行超 2 万亿参数大模型的超节点形态算力。该实例首批在内蒙古乌兰察布地域开售,企业无需自建机房即可在云端开通 64 卡高速互联算力单元,最高可承载十万亿参数级 MoE(混合专家)大模型推理。目前,Kimi K3 和 Qwen3.8-Max 模型已通过该实例对外提供服务。

在技术层面,灵骏真武 M890 支持 FP8/FP4 低精度计算,利用自研的 ICN Switch 1.0 芯片将 Scale-up 互联规模从 16 卡扩展至 64 卡,卡间互联带宽高达 800GB/s。相比上一代真武 810E,该实例在智能驾驶和具身智能等训练场景中的性能提升了 3 倍。基础设施方面,乌兰察布数据中心采用全模块设计架构,绿电占比约 90%,具备高兼容性和低碳特性。阿里云表示,计划今年将模块化数据中心全球产能提升两倍以上,后续将在更多地域开服。

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库

事件分析

此次发布的核心看点在于解决了 MoE(混合专家)大模型对超高显存和卡间互联带宽的双重需求。随着模型参数迈向十万亿级别,单体芯片显存已捉襟见肘,而跨节点通信损耗又是性能瓶颈。M890 通过自研芯片将 64 张 GPU 卡通过 800GB/s 的带宽全互联,构建了“单机即集群”的超节点形态,极大降低了通信延迟。这标志着云计算底层架构正从通用计算向面向 AI 高负载的专用互联架构演进,为国产大模型向更大规模迭代提供了必要的算力底座。

核心观点:算力竞争已从单卡性能转向互联带宽,超节点架构是十万亿参数时代云服务的必经之路。

原文链接:Linux.do

赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 阿里云发布灵骏真武 M890 超节点:国内首个支持十万亿参数大模型推理
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型