当前AI编程工具领域,针对Agent执行权限的“自动审核”功能(Approve for me)正成为提升开发效率的关键点。据开发者社区反馈,目前具备此功能的工具主要包括国外的Codex、Claude Code、Grok build以及Hermes Agent,国产阵营中仅Kimi Code有所涉猎,而像Zcode等其他主流国产Agent尚未跟进。
在技术实现路径上,各玩家存在显著差异。Codex采用专用模型(当前版本基于5.6-luna)进行审核,并将完整的代码上下文发送给审核模型,以确保决策的精准度。相比之下,Hermes Agent采取了更为轻量级的策略,仅将待执行的单条命令发送给可自定义的审核模型。这种差异化处理引发了对成本与收益的讨论:发送完整上下文虽消耗Token,但在底层模型(如Luna)成本可控的前提下,能提供更安全的决策环境;而Hermes的“命令级”审核则在极低Token消耗下实现了智能体的自动化运行。业内观察指出,国内厂商在引入这一功能上显得较为迟缓,尽管用户多次反馈,Zcode等平台仍未开放类似的自动审核机制。实际上,借鉴Hermes仅审核单条命令的方案,技术门槛低且Token成本几乎可忽略,却能大幅提升连续操作的用户体验,是目前AI编程工具亟待补齐的功能短板。
事件分析
相比之下,国内部分工具在功能覆盖度上仍停留在基础生成阶段,缺乏对开发者工作流中“微交互”体验的深耕。随着底层推理成本的降低,这种“双模型互博”或“主从模型”的模式将成为Agent产品的标配。未能及时跟进此类功能,反映出部分厂商在Agent架构设计上的保守,可能导致在开发效率工具的激烈竞争中处于劣势。
核心观点:自动审核缺失不仅是功能短板,更是Agent架构设计理念的差距;低成本的“监工模型”是实现全自动化的必经之路。
原文链接:Linux.do