普林斯顿 AI Lab Fellow、前字节跳动研究员 Yifan Zhang 近日透露,中国 AI 独角兽 DeepSeek 的下一代旗舰模型 V4 可能于下周发布。尽管 DeepSeek 官方尚未回应,但 Zhang 凭借其清华姚班及普林斯顿的学术背景,披露了三项核心架构组件:稀疏 MQA(优化长上下文算力)、融合 MoE 大核(减少 GPU 显存搬运)及 Hyper-Connections(改进残差连接)。这些技术从底层算子层面解决 LLM 推理的显存与延迟瓶颈,预示着 V4 将在保持高性能的同时进一步大幅降低部署成本。
普林斯顿博士爆料:DeepSeek V4或下周发布,三大架构创新聚焦推理降本
未经允许不得转载:80aj » 普林斯顿博士爆料:DeepSeek V4或下周发布,三大架构创新聚焦推理降本
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
John Ousterhout:TCP 和 RDMA 正拖慢 AI 推理,他想用 Homa 换掉它们
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价
技术指南:将免费DeepSeek模型接入Claude Code的实战方案