DeepSeek Harness 学习路线: 30 天做出只读数字分身
学习一个 Agent Runtime 最容易走偏的方式,是平均阅读所有文档,然后做一堆彼此无关的 demo。更有效的路线是围绕一个可验收产品逐层补能力:先让分身只读地认识你,再加入记忆、动作、权限和评测。下面的 30/90 天计划以这一顺序...
标签索引
这个标签下有 298 篇文章。按时间回看相关判断与实践记录。
标签精选
学习一个 Agent Runtime 最容易走偏的方式,是平均阅读所有文档,然后做一堆彼此无关的 demo。更有效的路线是围绕一个可验收产品逐层补能力:先让分身只读地认识你,再加入记忆、动作、权限和评测。下面的 30/90 天计划以这一顺序...
大模型只会聊天,不会办事——这是很多产品经理对 LLM 的第一印象,也是 Function Calling(函数调用,也常叫工具调用)要打破的那堵墙。学完这一课,你能回答三个问题:模型”调用工具”时到底发生了什么;一...
这几年关于 agent 可靠性的讨论,大部分停在 prompt 层:更细的系统提示、更清楚的工具描述、更谨慎的报错文案。Restate 的 Giselle van Dongen 在 AI Engineer World’s Fai...
我们自己这几个月往 .claude/skills/ 里塞的东西越来越多,写博客、发飞书消息、查日志,大多是一个文件夹加几份 Markdown,很少再专门写一段 Python 脚本去处理某个特殊情况。AI Engineer WorldR...
Self-Improvement of Context, Harness, and Model Weights through Reflective Optimization 这场分享来自 AI Engineer World’s...
Perception Agents 这场分享来自 AI Engineer World’s Fair 2026 Day 2 主舞台,讲者是 Antje Barth。本文只整理会议内容和分享脉络,不做个人使用心得。 原视频:http...
Jason Liu 的 Codex 分享很实用。他没有停在 “让 AI 帮我写一个函数”,而是把 Codex 当成能接任务、查资料、跑验证、回报结果的工作单元。 原视频:https://www.youtube.com...
OpenAI 的 Alexander Embiricos 和 Romain Huet 讲 “The Golden Age of AI Engineering”。这场不只是模型能力展示,它更像 OpenAI 对 Cod...
swyx 的开场只有几分钟,但它给这一天定了调。他没有把 AI Engineer World’s Fair 讲成一个普通大会,而是把它叫做 “the highest loop”:人聚在一起,讨论下一轮该把...
— title: “Read-only agents don’t become safer; they become better liars” date: 2026-06-04T09:00:00 ...