跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
前沿哨所

DeepSeek故障后性能实测:响应提速50%,疑似已大规模扩容GPU集群

1 分钟阅读阅读(52)
赞助推荐 团队协作里的 AI 办公工作台

今天下午DeepSeek经历约一小时故障后,服务恢复且性能指标显著优化。基于内部New-api调用DeepSeek-V4-Pro模型的数据分析显示,在Token生成速度(约33.5 tok/s)保持不变的情况下,缓存命中率微升,响应时间降低了40%至50%,首字延迟更是大幅缩减56%至76%。在输入输出量增加的情况下仍实现如此大幅度的延迟优化,分析认为这极大概率是因为DeepSeek后台进行了GPU算力扩容(扩卡),显著提升了系统的并发处理能力和响应效率。

原文链接:Linux.do

赞助推荐 一人公司 · 创业装备库
赞助推荐 一人公司 · 创业装备库
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » DeepSeek故障后性能实测:响应提速50%,疑似已大规模扩容GPU集群
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 低成本上手 Claude Code 的中转选择
赞助推荐 一键部署 AI 大模型
赞助推荐 一键部署 AI 大模型