一名开发者针对DeepSeek、Kimi、智谱GLM及Gemini四款主流大模型进行了代码生成能力的横向对比。测试条件仅使用“生成坦克大战游戏”这一极简提示词,并要求开启联网与思考模式。实测结果显示,智谱GLM生成的游戏在完整度和可玩性上最接近预期;DeepSeek虽为简化版但配色风格出色;Kimi表现较为混乱;而Gemini不仅未能成功预览,生成的代码也最为简陋。此次测试直观地揭示了各家模型在处理复杂逻辑与前端工程化任务上的实际水平差异。
AI大模型代码生成实测:极简Prompt下智谱GLM夺冠,Gemini意外掉队
未经允许不得转载:80aj » AI大模型代码生成实测:极简Prompt下智谱GLM夺冠,Gemini意外掉队
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
Opus 4.8 把"诚实"当成了卖点
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价
英伟达发布SANA-WM:单卡可运行的高效开源视频生成模型