AI芯片独角兽Cerebras近日发布公告,由于两款特定的高级模型(包括zai-glm-4.7和qwen-3-235b相关变体)访问量激增,导致资源紧张,平台不得不暂时降低免费使用层的速率限制。这一调整侧面反映了市场对高性能AI推理服务的强劲需求。Cerebras表示,技术团队正在全力优化基础设施,力求尽快恢复原有的服务配置,以保障用户体验。
因需求火爆,Cerebras 暂时下调部分高级模型的免费层速率限制
未经允许不得转载:80aj » 因需求火爆,Cerebras 暂时下调部分高级模型的免费层速率限制
相关推荐
John Ousterhout:TCP 和 RDMA 正拖慢 AI 推理,他想用 Homa 换掉它们
疑似套壳Gemini?社区热议国产大模型Qwen是否存在蒸馏行为
24GB内存M4 MacBook实战:如何高效运行本地大模型与AI编程?
支持Vercel一键部署!开源项目Qwen-Proxy发布,集成代理池与工具调用
揭秘Gemini "DeepThink":利用DeepSeek反向套取出的系统提示词全解析
挑战RAG极限!开发者构建AI系统,在1000万字小说中自主推理出全书未明身世之谜
Qwen 3.6 Plus 实测表现:手写识别能力碾压 GPT,但 AI 为什么总爱“加戏”?
实测 MTP 技术让推理速度翻倍:Qwen 3.6 表现亮眼,为何 Gemma 4 仍缺席?