跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
前沿哨所

Gemini 3.8 Flash被挤爆:谷歌承认高负载报错,承诺重置速率限制

3 分钟阅读阅读()
赞助推荐 团队协作里的 AI 办公工作台

谷歌旗下智能体编程平台Antigravity近日发布公告,确认平台在运行Gemini 3.8 Flash模型时正面临高负载压力,部分用户请求出现报错。官方表示团队正在积极修复相关问题,一旦解决将立即重置速率限制,以恢复用户的正常使用体验。Antigravity是谷歌推出的智能体开发平台,随Gemini 3系列一同亮相,深度整合Gemini模型能力,面向开发者提供多智能体协作的编程环境。Gemini Flash系列则是谷歌大模型产品线中主打响应速度与推理成本的产品,凭借较低的调用门槛和快速输出能力,成为大量开发者在日常编码、原型验证场景中的常用选择。此次高负载问题恰逢Gemini 3.8 Flash发布后的使用高峰期。由于Flash版本在实际体验中展现出接近旗舰模型的性能,同时速率限制相对宽松,大量用户涌入Antigravity平台调用该模型,导致服务端请求量激增,部分请求触发报错。速率限制的收紧进一步加剧了用户的不满,社区中关于额度不足与响应变慢的讨论持续升温。谷歌此次回应态度较为直接,承认速度与额度问题的存在,并承诺修复完成后重置速率限制,意味着用户短期内有望获得更宽松的调用额度。但高负载下的服务稳定性问题能否彻底解决,仍取决于谷歌后续的算力扩容与流量调度策略。

事件分析

从技术角度看,Flash系列模型以高吞吐、低延迟为核心卖点,其服务架构本应擅长应对高并发场景,此次出现请求报错,说明Gemini 3.8 Flash的实际请求量已远超谷歌的容量预估。AI编程场景请求频率高、会话密集、上下文长,对推理集群的压力远超普通对话场景,这对调度与容错能力提出更高要求。从产业角度看,该事件侧面印证了智能体编程工具的用户增长速度:Antigravity以较低使用门槛开放,大量开发者与泛用户涌入后,推理成本与容量规划成为所有AI编程产品面临的共同难题。类似的高负载状况在Claude Code、Cursor等主流工具上也曾多次出现。后续走向方面,谷歌大概率会采取动态速率限制、分时段调度、优先级队列等策略平衡供需,同时加速算力扩容。在算力供给难以短期跟上的背景下,此类限流与额度重置的循环短期内或将成为行业常态。

核心观点:当速度成为卖点,人潮就成了诅咒:推理容量供需失衡,正成为AI编程工具竞争的隐形战场。

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库

原文链接:Linux.do

赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » Gemini 3.8 Flash被挤爆:谷歌承认高负载报错,承诺重置速率限制
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型