云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
DigitalOcean 开发者云
FoxCode AI Coding 助手

AI Agent 框架

LangChain / LangGraph / LangSmith / Langfuse / n8n / Dify / Coze / FastGPT / AutoGen / CrewAI 等主流 Agent 框架的横向对比、真实业务案例与 cookbook。
Apache Burr 实战: 状态机构建可恢复 AI Agent,对比 LangGraph-80aj

Apache Burr 实战: 状态机构建可恢复 AI Agent,对比 LangGraph

TL;DR 写过几个 LLM 应用的人多半都经历过同一条曲线:第一版是几行脚本,prompt 拼好、调一次模型、打印结果,跑通了很开心。等到要做多轮对话、要带记忆、要在某一步插入人工审批、要在出错后从中间继续——那几行脚本就开始膨胀成一团互...

赞(0)ToyToyAI 阅读(66)
Claude Cowork vs Manus:自主 Agent 怎么选-80aj

Claude Cowork vs Manus:自主 Agent 怎么选

2026 年上半年,”自主 AI Agent”这个词从概念变成了两个能真正下单买来用的产品:Anthropic 在 1 月发布的 Claude Cowork,和已经迭代一年多的通用自主代理 Manus。两者都宣称能&...

赞(0)ToyToyAI 阅读(250)
AI Code Review 的架构选择:把 CPG 建在 master 上-80aj

AI Code Review 的架构选择:把 CPG 建在 master 上

写过几年代码评审工具的人都知道,PR Review 真正的瓶颈不是 LLM 的输出能力,而是 LLM 看不见的上下文——一个改动在跨文件、跨模块、跨服务之后真正影响了什么。 最近这一年,AI Code Review 的产品越冒越多:PR-A...

赞(0)ToyToyAI 阅读(41)
Loop Engineering 是 Harness 的局部命名-80aj

Loop Engineering 是 Harness 的局部命名

最近一个词在 AI 圈被反复提起:Loop Engineering,循环工程。01Coder(小木头)做了一期视频把这件事讲了一遍,原视频在文末。我看完顺手对了一下自己手里这一年的笔记,想说一句直接点的:它没那么新,但 Boris Cher...

赞(0)ToyToy架构 阅读(52)
LLM 评测的下一步是一张二维矩阵-80aj

LLM 评测的下一步是一张二维矩阵

过去十几年,工程师调 bug 看的是 stack trace。stack trace 是”代码的执行路径”,每一帧是确定的、可重放的,错了往上翻几层就能定位。 最近两年,工程师开始调 agent。agent 没有 s...

赞(0)ToyToy架构 阅读(32)
Prompt Learning 的两个反馈圈-80aj

Prompt Learning 的两个反馈圈

最近半年,业界几乎所有团队都在抱怨 agent 不可靠。模型选了最贵的,工具调用接全了,上下文也尽量塞满,可输出依然时好时坏。换一个模型也救不回来。问题出在哪里? Arize 的 SallyAnn DeLucia 和 Fuad Ali 在 ...

赞(0)ToyToy架构 阅读(59)
构建 Agent 和写软件,是两种工程-80aj

构建 Agent 和写软件,是两种工程

写了十年代码的工程师,上手 AI Agent 时常常比新人还别扭。不是能力问题,是直觉问题——越熟练的旧直觉,越容易在 agent 面前变成包袱。 Google DeepMind 的 Philipp Schmid 在 AI Engineer...

赞(0)ToyToy架构 阅读(79)
Agent Harness 不是要安装的软件包-80aj

Agent Harness 不是要安装的软件包

做生产级 Agent,很多人第一反应是挑一个框架、看一眼文档、运行一下 Hello World,然后觉得大事已定。 Mike Piccolo 的文章 How to Build Your Own Agent Harness 直接拆穿了这个幻觉...

赞(0)ToyToy架构 阅读(101)
把 Agent 送上生产:RAG、工程、安全、评测-80aj

把 Agent 送上生产:RAG、工程、安全、评测

作者:toy 一、为什么最后一篇要把这四件事放在一起 这个系列到了第九篇,前八篇依次拆解了 Agent 的基础理论、规划推理、开发框架、工具调用、记忆模块、微调方案、推理服务、显存优化。每一篇都可以单独成立,但如果你真的要把 Agent 推...

赞(0)ToyToyAI 阅读(119)
搭 Agent 的脚手架:主流开发框架-80aj

搭 Agent 的脚手架:主流开发框架

作者:toy 一、为什么需要 Agent 框架 从”手写循环”到框架 构建一个最简单的 ReAct Agent,大概需要五十行 Python:一个 while 循环,调 LLM,解析输出,调工具,把结果塞回上下文,再...

赞(0)ToyToyAI 阅读(123)
让 Agent 会思考:规划与推理范式-80aj

让 Agent 会思考:规划与推理范式

作者:toy 大多数人第一次看到 ChatGPT 流式输出时,误以为模型在”思考”。实际上它在做一件更机械的事:每次预测下一个 token 的概率分布,然后采样。这个过程里没有回溯,没有规划,没有对全局的感知。一个字...

赞(0)ToyToyAI 阅读(103)

GLM Claude Code · 国产平替不封号

官方 Claude Code 又涨价又要 KYC,封号还得重配环境?智谱 GLM 兼容 Claude Code,稳定不封号、价格友好,注册后把现有 Claude Code 工作流直接切过来继续用。

立即体验 GLM查看套餐价格