一位开发者在 V2EX 上分享了使用 Codex(5.3-codex-high)与 Claude Code 的实战体验。尽管在提示词中明确设置了“完成工作后确认”的指令,Codex 仍经常无视流程直接全盘执行;即便切换至计划模式,它也会跳过“将计划写入文档”的步骤直接开始写代码。该开发者认为,在指令遵循性和工作流控制方面,Claude Code 的表现明显优于 Codex,这反映了当前 AI 编程助手在平衡“自主性”与“可控性”方面的技术差异。
开发者实测:Codex 指令遵循能力不及 Claude Code,自主性过强导致流程失控
未经允许不得转载:80aj » 开发者实测:Codex 指令遵循能力不及 Claude Code,自主性过强导致流程失控
相关推荐
我用 AI 做完一个产品后,留下了这套交付闭环
DeepSeek Harness vs LangGraph: 数字分身 Runtime 怎么选
Cursor 的第一处改动:从规则到验证
Karpathy 讲透 Software 3.0:当英文成为编程语言,AI 工程师真正该设计什么
杀死代码评审:AI 写代码、AI 审代码之后,人剩下的是对齐
我把 Codex 上的几十个 Skill 迁移到了 DeepSeek Harness,全程可用
AI Agent 做 TDD 有没有用: 实测排名与 3 倍 token 成本
Codex 背后的 Harness:OpenAI 把 Coding Agent 的控制层讲透了