跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
前沿哨所

阶跃星辰发布Step 5 Preview:600B参数MoE架构,官宣10月15日开源

3 分钟阅读阅读()
赞助推荐 团队协作里的 AI 办公工作台

阶跃星辰正式发布新一代大模型Step 5 Preview,官方称其在AI编程、软件工程、专业知识工作等任务上达到前沿水平,并在金融领域表现尤为突出。该模型采用稀疏MoE架构,总参数量达600B,每个Token激活27B参数,支持1M Token上下文窗口和视觉输入,现已可通过阶跃星辰产品和API使用,模型将于10月15日正式开源。官方公布的评测结果显示,Step 5 Preview在多项基准测试中表现优异:GPQA Diamond得分93.5%,Terminal-Bench v2.1得分85.0%,BrowseComp得分88.7%,多模态基准MMMU-Pro得分76.0%。官方将其与GLM 5.3、Kimi K3、GPT-6 Astra、Claude Fable 5.1、Claude Opus 5等模型进行横向对比,Step 5 Preview在AA-LCR、CyberGym、FinStepBench等多个基准上取得最佳或次佳成绩,被定位为新一代“帕累托前沿”,跻身国产模型第一梯队。需要注意的是,评测中的StepCodeBench、FinStepBench等部分基准为阶跃星辰内部自研,且HLE w/ tools等项目在不同模型间的评测设置存在差异,官方亦说明不同设置下的结果不具备直接可比性。

事件分析

Step 5 Preview的核心技术看点在于600B总参数与27B激活参数的高稀疏比,该配置在保持大规模模型能力上限的同时摊薄单次推理成本,符合当前旗舰模型的主流工程路线。1M上下文与视觉输入的结合,指向长文档处理与多模态Agent等高价值场景。值得注意的细节是,官方评测中相当比例基准为内部自研(带†标注),如StepCodeBench与FinStepBench系列,自研基准与第三方基准混合呈现,开源后社区独立复测的结论将更具参考价值。产业层面,金融方向的重点评测布局显示阶跃星辰在垂直行业商业化上的明确侧重。10月15日开源后,许可证条款、权重完整性及部署所需的硬件门槛,将决定该模型在开发者生态中的实际扩散程度,并影响国产开源阵营与国际闭源模型的竞争态势。

核心观点:开源已成国产旗舰模型的标配打法,但参数与跑分之外,许可证与硬件门槛才是决定生态影响力的真正变量。

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库

原文链接:Linux.do

赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 阶跃星辰发布Step 5 Preview:600B参数MoE架构,官宣10月15日开源
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型