标签索引
AI 编程
这个标签下有 2494 篇文章。按时间回看相关判断与实践记录。
标签精选
相关内容
我用 AI 做完一个产品后,留下了这套交付闭环
AI 编程可以很快生成代码,稳定交付还需要规格、工具与验证组成闭环。本文用一个电子书阅读器案例拆解五步流程,并说明 Git、AI 自测和人工验收为什么是最低护栏。
DeepSeek Harness vs LangGraph: 数字分身 Runtime 怎么选
DeepSeek Harness 的竞争对象不是某个聊天界面,而是承担状态、工具、执行与恢复的 Agent Runtime。选型时如果只比功能清单,很容易把框架的演示能力当成生产能力。本文把 DSH 与 LangGraph、Microsof...
Cursor 的第一处改动:从规则到验证
很多人第一次用 Cursor,会让 Agent 直接“把这个功能做完”。它往往真能改出一堆文件,但你很难判断哪一处是对的,哪一处只是看起来像对的。 我更建议把第一次任务当成一次小型交接:选一个能看见、能测试、能回退的改动。Cursor 负责...
Karpathy 讲透 Software 3.0:当英文成为编程语言,AI 工程师真正该设计什么
Andrej Karpathy 在 Stanford 的这场演讲,表面上是一场关于 Transformer、GPT 和提示工程的技术分享,真正值得留下的核心判断只有一句:软件正在从“人来设计算法”,转向“人来设计数据和语言程序”。模型能力越...
杀死代码评审:AI 写代码、AI 审代码之后,人剩下的是对齐
本文整理自 AI Engineer 大会上 Aviator 联合创始人 Ankit Jain 的演讲《How to Kill the Code Review》。他几个月前写过一套「杀死代码评审」的五层信任模型,这次上台主要做自我修正:评审从...
我把 Codex 上的几十个 Skill 迁移到了 DeepSeek Harness,全程可用
AI 竞争已经打到了第三层。第一层拼基础模型——GPT、Claude、Gemini 谁更强;第二层拼 Agent——Codex、Claude Code、Trae 谁更好用。DeepSeek 上周扔出一件新东西,直接把战场拉到了第三层:Har...
AI Agent 做 TDD 有没有用: 实测排名与 3 倍 token 成本
过去一年里,”让 AI 写测试优先”几乎成了 AI 编程的政治正确。绝大多数被传播的 CLAUDE.md、AGENTS.md、.cursorrules 里,都能找到一句”先写失败的测试,再写实现̶...
Codex 背后的 Harness:OpenAI 把 Coding Agent 的控制层讲透了
本文整理自 OpenAI Dominik Kundel 在 AI Engineer World’s Fair 的演讲。它真正值得看的地方,不是 Codex 又多了几个功能,而是 OpenAI 正在把 coding agent 的关键能力从“...
代码写作快免费了,软件工程反而更难了
Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness ...









