据科技社区 Linux.do 汇总的消息,Google 在即将到来的 I/O 2026 大会前泄露了其 AI 战略的核心布局。首先,Gemini Omni 模型被定义为“全模态”解决方案,不仅支持全类型输入,其突破性在于输出端,特别是实现了对视频内容的编辑与生成能力,这标志着多模态 AI 从理解层面向创作与修改层面的重大跨越。其次,Gemini 3.5 Flash 模型着重优化了推理性能,据称其输出速度高达 1500 tokens/s,这一速度远超当前主流模型,基本实现了实时流式生成,能够极大地消除用户在复杂交互中的感知延迟。此外,Google 还计划推出代号为 Spark 的新模型,被视为 Google 版的“Claude”,旨在优化特定的对话或推理场景。底层生态方面,Google 搜索将迎来架构级升级,正式支持多模态输入,不再局限于传统的文本关键字检索。这些更新预示着 Google 正在通过极致的性能提升和全模态能力,构建下一代 AI 操作系统的雏形。
事件分析
💡 核心观点:谷歌试图通过极致的推理速度与全模态生成能力,重新定义AI交互的实时性标准,将大模型竞争从单纯的智能比拼推向了即时生产力工具的维度。
原文链接:Linux.do





