跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
前沿哨所

Mercury 2发布:采用扩散技术,推理速度突破每秒1000 tokens

1 分钟阅读阅读(177)
赞助推荐 团队协作里的 AI 办公工作台

Inception Labs 发布了号称全球最快的推理大语言模型 Mercury 2。不同于传统 Transformer 的自回归逐字解码,该模型创新性地利用扩散技术进行并行文本精炼,实现了生成模式的根本性改变。在 NVIDIA Blackwell GPU 上,其生成速度超过每秒 1000 tokens,且在高并发下保持极低延迟。这一突破大幅降低了推理成本,使得在实时语音交互、代码编写及复杂 Agent 循环等延迟敏感场景中应用高级推理能力成为可能,目前已开启 API 早期访问。

原文链接:Hacker News

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » Mercury 2发布:采用扩散技术,推理速度突破每秒1000 tokens
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型