云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本

谷歌缩减免费算力?Gemini 网页端未登录版被曝降级至 Flash Lite

云聚 AI Token Plan 满 199 减 35 元

近日,有技术社区用户反馈,Google Gemini 网页端的未登录访问策略发生了显著变化。据观察,当用户通过浏览器隐私模式(无痕浏览)访问 Gemini 而未登录 Google 账号时,系统后台分配的默认推理模型已由原先的 Gemini 1.5 Flash 标准版,降级为被称为 “Flash Lite” 的轻量化版本。用户发帖表示,这一调整似乎是在近期突然实行的,早些时候未登录状态下尚能调用性能更强的模型版本。此外,用户还抱怨称,目前即便是 Gemini 1.5 Pro 模型的响应速度也较为迟缓,质疑 Google 是否正在收紧免费算力的供给。从技术细节来看,所谓的 “Lite” 版本通常指经过蒸馏或剪枝的低参数量模型(如 1.5B 参数),虽然响应速度极快,但在复杂逻辑推理、指令遵循及代码生成能力上与标准版存在客观差距。这一现象表明,Google 正针对匿名访客调整资源分配策略,可能意在通过降低服务体验来推动用户注册登录,或者单纯为了应对海量免费请求带来的巨大基础设施成本压力。

事件分析

此次事件标志着大模型厂商在“免费获客”与“成本控制”的博弈中进入了新阶段。未登录网页端往往是流量入口,也是算力消耗的黑洞。将未登录用户模型切换至轻量化版本(如小参数模型),能够在维持基本服务在线的同时,大幅降低 GPU 推理成本。这反映出行业正从早期的“不计成本扩张”转向“精细化运营”。对于开发者而言,这意味着高质量的 AI 交互能力将越来越依赖账号体系、付费订阅或 API 调用,纯粹的、匿名的全功能免费使用入口可能会逐渐受限。这也侧面印证了当前 AI 基础设施在高并发下的成本压力,以及小模型(Small Language Models)在低成本场景下的应用价值。

💡 核心观点:大模型免费时代的终结信号:厂商正通过降级未登录体验,将核心算力成本向登录墙和付费墙内转移。

阿里云 OPC 一人公司创业装备库

原文链接:Linux.do

阿里云函数计算 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 谷歌缩减免费算力?Gemini 网页端未登录版被曝降级至 Flash Lite
赞助推荐 FreeModel.dev Claude Code 中转
阿里云函数计算 一键部署 AI 大模型