Vertex AI服务延迟异常:Gemini模型首Token输出超17秒
近日有开发者报告,在使用Google云平台Vertex AI服务调用Gemini-3-pro-preview模型时,发现流式输出出现严重延迟问题。从位于美国硅谷的基础设施发起的API调用显示,首Token延迟(TTFT)持续超过17秒,而正...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
近日有开发者报告,在使用Google云平台Vertex AI服务调用Gemini-3-pro-preview模型时,发现流式输出出现严重延迟问题。从位于美国硅谷的基础设施发起的API调用显示,首Token延迟(TTFT)持续超过17秒,而正...