8月25日,据魔搭社区(ModelScope)及IT之家等媒体报道,阿里云“千问”大模型团队正式预告,将于北京时间8月26日23:00开源新模型“Qwen3.8-Flash-Next”。此次发布将包含Qwen3.8-Flash-Next及其FP8量化版本。尽管模型名称延续了此前的参数量级命名,但该模型是基于下一代Qwen4架构构建的首个公开版本,并采用了多模态MoE(混合专家)架构。官方指出,提前发布该模型旨在让开发社区能够率先体验并适应新架构的改进,为即将推出的完整Qwen4模型家族做好准备。目前,官方尚未公布该模型在多模态理解和推理能力方面的具体评测数据,但FP8版本的发布暗示了其对推理效率和显存优化的重视。开发者现可在魔搭社区关注相关动态。
事件分析
此次事件标志着阿里“千问”大模型技术路线的重要迭代。基于Qwen4架构的提前曝光,显示出开源大模型领域的竞争已从单纯追求参数量转向架构效率的比拼,特别是MoE架构的应用,意在通过稀疏激活机制在保持高性能的同时降低推理成本。提供FP8版本进一步印证了业界对端侧部署和高性价比推理的强烈需求。通过在完整家族发布前推出“Flash-Next”这种过渡性质的模型,阿里实际上是在进行大规模的技术灰度测试,既能验证新架构在社区环境下的稳定性,也能提前绑定开发者生态,为Qwen4的正式发布积累人气与反馈。此外,“多模态”能力的确认,意味着Qwen4将原生支持图像等非文本输入,这对齐GPT-4o等领先模型的关键一步。
核心观点:Qwen4架构的首次开源预览暗示MoE与多模态已成为大模型进化的核心路径,旨在以更低成本实现更强性能。
原文链接:Linux.do