神秘模型揭晓:蚂蚁 Ling-2.6-flash 登场,专为 AI Agent 打造的极速 MoE
此前在 OpenRouter 上引发猜测的神秘模型“Elephant Alpha”确认为蚂蚁集团(InclusionAI)研发的 Ling-2.6-flash。该模型采用混合专家架构,拥有 104B 总参数,但推理时仅激活 7.4B 参数,...
标签索引
这个标签下有 2 篇文章。按时间回看相关判断与实践记录。
标签精选
此前在 OpenRouter 上引发猜测的神秘模型“Elephant Alpha”确认为蚂蚁集团(InclusionAI)研发的 Ling-2.6-flash。该模型采用混合专家架构,拥有 104B 总参数,但推理时仅激活 7.4B 参数,...
Flash-MoE 项目展示了极致的软件优化能力,通过纯 C 语言和 Metal 编写的推理引擎,成功在仅配备 48GB 内存的 MacBook Pro (M3 Max) 上流畅运行 3970 亿参数的 Qwen3.5 混合专家模型(MoE...