据英国《金融时报》援引三名知情人士消息,字节跳动已正式启动代号为“未知”的下一代大模型预训练项目,其目标参数规模最高可达 10 万亿。若按此上限完成训练,该模型体量将超过 Moonshot AI(Kimi)K3 模型的三倍以上,成为中国团队中参数规模最大的模型。从全球视角看,字节此举直接对标美国顶尖闭源模型团队。行业估算 Anthropic 的旗舰模型 Mythos 5 参数约为 8 万亿,字节新模型若达到 10 万亿,将在参数规模上跻身世界最前沿梯队。目前该项目仍处于预训练初期,预计需 3 至 6 个月完成基础能力训练,随后进入后训练阶段。值得注意的是,张一鸣近期在内部明确反对通过“蒸馏”竞争对手模型来快速追赶,而是要求团队接受暂时的落后,坚持自研路径冲击第一梯队。尽管参数规模是提升模型能力的重要维度,但业界普遍认为,最终表现仍取决于模型架构、训练数据质量及训练方法。此次字节跳动的激进投入,标志着国内大厂在 AI 竞赛中进入了“暴力美学”与“自研深度”并重的全新阶段。
事件分析
💡 核心观点:拒绝捷径转向暴力美学,字节跳动试图以绝对的参数规模豪赌,换取通往AGI的技术代差。
原文链接:Linux.do





