DeepSeek 近日通过官方渠道发布关键更新,宣布其 API 服务已全面完成输出速度提升与服务扩容。此次升级旨在解决近期因 DeepSeek-R1 及 V3 模型爆火而导致的服务器拥堵与响应延迟问题。根据官方披露的信息,优化后的 API 在推理生成阶段展现出更快的输出速度,且整体服务稳定性得到显著增强。在并发处理能力方面,系统默认支持 500 个并发连接同时在线,这一指标的大幅提升基本满足了绝大多数开发团队与企业用户的常规调用需求。针对对并发量有更高要求的大型企业客户,DeepSeek 已开放在线申请通道以获取定制化的资源配额。此外,技术社区的反馈信息显示,此次服务能力的突发式跃升可能得益于华为昇腾算力卡(Ascend)的到位与部署。此前 DeepSeek 因算力短缺导致平台频繁宕机,若此次确系引入华为国产算力集群进行分流与扩容,这标志着国产高性能 AI 芯片在支撑亿级用户大模型推理方面已具备成熟的工程化落地能力,同时也为国产大模型的供应链安全提供了重要保障。
事件分析
💡 核心观点:DeepSeek 的服务瓶颈若由国产算力突破,标志着国产大模型已初步解决“卡脖子”的算力工程难题,实现软硬协同的规模化落地。
原文链接:Linux.do





