Google DeepMind 悄然推出了 Gemini 3.1 Flash-lite 预览版,旨在为高频任务提供极致的效率与智能。根据官方数据及 Artificial Analysis 基准测试,该模型速度相比 2.5 Flash 提升了 2.5 倍,输出速度提高 45%,且显著缩短了首字生成延迟。在定价方面,该模型极具竞争力,输入成本仅为每百万 token 0.25 美元。这使其在保持高质量输出的同时,成为实时翻译等大规模、低延迟应用场景的理想选择。
Google DeepMind 悄然推出了 Gemini 3.1 Flash-lite 预览版,旨在为高频任务提供极致的效率与智能。根据官方数据及 Artificial Analysis 基准测试,该模型速度相比 2.5 Flash 提升了 2.5 倍,输出速度提高 45%,且显著缩短了首字生成延迟。在定价方面,该模型极具竞争力,输入成本仅为每百万 token 0.25 美元。这使其在保持高质量输出的同时,成为实时翻译等大规模、低延迟应用场景的理想选择。