对标顶尖大模型:科大讯飞星火 X2-Flash 发布,基于华为昇腾 910B 实现 256K 长文本
科大讯飞正式发布新一代大模型“星火 X2-Flash”。该模型采用 MoE 混合专家架构,总参数 30B,最大支持 256K 超长上下文,宣称在智能体与代码生成能力上大幅提升。技术层面上,该模型基于华为昇腾 910B 集群训练完成,这标志着...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
科大讯飞正式发布新一代大模型“星火 X2-Flash”。该模型采用 MoE 混合专家架构,总参数 30B,最大支持 256K 超长上下文,宣称在智能体与代码生成能力上大幅提升。技术层面上,该模型基于华为昇腾 910B 集群训练完成,这标志着...