受OpenAI渠道收紧影响,开发者群体开始大规模转向国产大模型,但初期的使用反馈并不理想,普遍存在智商下降和响应速率慢的问题。针对这一现状,有开发者发起了一项自费评测计划,拟对讯飞、阿里、火山、智谱、无问、Minimax、Kimi、腾讯及联通等九家主流厂商的“编程版模型”进行全面测试。评测将重点关注速率、逻辑推理能力(抗降智)及工具兼容性,旨在通过真实场景的严苛测试,筛选出真正具有生产力价值的国产AI工具,测试后的剩余额度也将向社区开源共享。
开发者自费横评国产大模型:实测阿里、讯飞、Kimi等九大厂商编程能力
未经允许不得转载:80aj » 开发者自费横评国产大模型:实测阿里、讯飞、Kimi等九大厂商编程能力
相关推荐
Trae vs Cursor 怎么选:国产与海外 AI 编程 IDE 对比
Kimi被曝全面下架Claude模型,仅剩自研与国产大模型
ChatGPT订阅受阻成常态:开发者为何纷纷倒向DeepSeek API?
无需API Key免费调用DeepSeek V4与Kimi,开发者CLI工具Freebuff发布
企业AI编程落地困局:国产模型频遭吐槽,Claude虽强但因安全难用
Harness Engineering实测:工程框架能否弥补国产大模型的短板?
Claude Opus 情感陪伴成本高昂,如何平衡 AI“情商”与 Token 账单?
网页版 Gemini 遭遇大规模风控?谷歌 AI 在华可用性引发热议