DeepSeek故障后性能实测:响应提速50%,疑似已大规模扩容GPU集群
今天下午DeepSeek经历约一小时故障后,服务恢复且性能指标显著优化。基于内部New-api调用DeepSeek-V4-Pro模型的数据分析显示,在Token生成速度(约33.5 tok/s)保持不变的情况下,缓存命中率微升,响应时间降低...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
今天下午DeepSeek经历约一小时故障后,服务恢复且性能指标显著优化。基于内部New-api调用DeepSeek-V4-Pro模型的数据分析显示,在Token生成速度(约33.5 tok/s)保持不变的情况下,缓存命中率微升,响应时间降低...
近日,Linux.do 社区有用户反馈称 Gemini CLI(命令行工具)疑似实行了后台新规,导致 Gemini 3.1 Pro 模型的生成与响应速度出现肉眼可见的大幅提升。一位从事小说写作的用户表示,原本需要较长时间的代码与文本修改流程...
有用户反馈使用GLM 4.6 max套餐与Claude代码结合时,执行一个需求从分析到修改代码需要约20分钟,感觉速度过慢。用户询问是否存在使用方法不当或可优化的解决方案。这一讨论反映了当前AI大模型在实际应用中可能面临的性能瓶颈问题,对于...