让 Agent 会思考:规划与推理范式
作者:toy 大多数人第一次看到 ChatGPT 流式输出时,误以为模型在”思考”。实际上它在做一件更机械的事:每次预测下一个 token 的概率分布,然后采样。这个过程里没有回溯,没有规划,没有对全局的感知。一个字...
标签索引 / 第 7 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
作者:toy 大多数人第一次看到 ChatGPT 流式输出时,误以为模型在”思考”。实际上它在做一件更机械的事:每次预测下一个 token 的概率分布,然后采样。这个过程里没有回溯,没有规划,没有对全局的感知。一个字...
作者:toy | 覆盖周期:2026.5.16 – 2026.5.29 这一周,AI 公司密集地按下了两个按钮:上市和融资。OpenAI 在 5 月 22 日向 SEC 秘密递交了招股书,目标估值最高一万亿美元;六天后,Anthropic ...
这篇文章整理自 The Gray Cat 对 GSD 和 OpenSpec 的一次实测对比:同一个中型写作社区产品,同一个 PRD、同一个模型、同一个 Codex CLI。真正值得看的是,它把 Agent 框架到底在约束“改动”还是“项目”...
你可能听过一个直觉:C++ 比 Python 快很多倍,所以 llama.cpp(C++ 写的)应该比 vLLM(Python 写的)快很多倍。实测打脸——同一个模型同一张卡,vLLM 在不少场景下比 llama.cpp 还快。这就是 Ca...
这篇分享最有价值的地方,不是又一次鼓吹 AI 写代码,而是把一个更容易被忽略的事实说透了:在大型代码库里,真正提升产出的常常不是生成能力,而是理解能力。 本文整理自 Sentry 工程师 Priscila Andre de Oliveira...
本文整理自灵姐说AI对 Google I/O 2026 的深度解读。比起逐条数发布会功能,更值得看的是一个更大的判断:OpenAI 正在做超级 App,而 Google 想把 Gemini 塞进搜索、Workspace、YouTube、An...
Transformer 刚出来时,很多人把注意力都放在 self-attention 上。那当然没错,因为它确实重新定义了模型怎么看上下文。但如果只盯着 attention,你会漏掉另一个同样关键的问题:模型怎么知道词序? 这是我看完这期视...
自然语言天生有歧义。 "The detective followed the spy with binoculars." 这句话有两个完全合理的理解:侦探拿着望远镜跟踪间谍,或者间谍带着望远镜刚好被侦探跟上了。人脑能瞬间意识到两种可能,但早...
本文整理自张小珺 Podcast 对姚顺宇的访谈。这篇文章不再按访谈流水账复述,而是重新整理成一条更清楚的主线:当头部模型能力逐渐趋同后,大模型竞争为何会从天才叙事,转向组织能力、产品定义和长期执行。原视频:https://www.yout...
过去语言大模型(LLM)因基于概率预测字符,常在 10+11 等基础计算中出错。但随着 Agent(智能体)范式的引入,这一难题正被攻克。在 Agent 逻辑下,模型能识别计算任务并自动编写脚本求解,将逻辑确定性交给代码执行。这种转变标志着...