跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

持续更新

更多文章

工程实践

AI 写代码,人退到了两头

有个概念我最近一直在用,叫”聪明区”和”笨蛋区”。提出它的是 Human Layer 的 Dex Hardy:一个大模型刚开始一段新对话时最聪明,因为这时注意力关系最松弛;你每往上下文里塞一个...

19 分钟阅读63 阅读
架构设计

SAG 细读:用 SQL join 替图数据库的 RAG 实现

RAG 这个领域过去两年的主流方向是”补结构”。GraphRAG、HyperGraphRAG 都在解决一个问题——纯向量检索没法处理多跳推理,得给文档之间补上关系图。代价是要预先把整张知识图谱建好,存进图数据库,增量...

16 分钟阅读232 阅读
生活随笔

记住一个表达,从来不是因为努力记住它

我们都被同一种语言学习的失败困扰过:单词背了几千,听到 native speaker 还是要先翻译,张嘴前先在脑子里走一遍中文。这件事的归因,过去几十年都摁在”方法不对”上:是不是背单词的姿势错了,是不是语法没刷够。...

8 分钟阅读85 阅读
架构设计

WebMCP:把网站变成给 agent 的 API

让 AI 帮你买两张演唱会的票,它背后要做多少事? 按今天的做法,agent 会先把整个页面的 DOM 抓下来,再读一遍无障碍树(accessibility tree)去理解页面结构,然后截一张图,分析那些在 HTML 里看不到的元素,最后...

11 分钟阅读73 阅读
AI 大模型

Agent 上不了网,却告诉你它查过

我先给一种失败模式起个名字:隐性失败。没有报错,没有警告,没有任何异常提示,你拿到的只是一个错答案。 这是 Bright Data 的 Rafael Levi 在 AI Engineer 大会上一场演讲的主题。他做的是帮 agent 大规模...

10 分钟阅读95 阅读
架构设计

从写 Prompt 到写 Loop

最近翻硅谷工程师的讨论,有个变化挺明显:以前大家比谁的提示词写得漂亮,现在开始比谁的循环设计得好。 OpenClaw 的创始人 Peter Steinberger 在六月初发了条帖子,被看了八百多万次。他说,别再忙着主动提示你的 codin...

14 分钟阅读127 阅读
架构设计

1M 上下文,难点已经换了地方

一年前,模型支持 100 万 token 上下文还是发布会上的高光环节。现在它更像手机快充,人人都有,没有反而奇怪。Claude、OpenAI、Gemini 在海外,DeepSeek、MiniMax、Kimi、智谱在国内,新发布的模型几乎默...

8 分钟阅读193 阅读
AI 大模型 #AI 模型横评

大模型的胜负手已经不在结构,而在效率

Paul 这一讲一开场就先打了个预防针:今天讲的是高度浓缩版的内容,MIT 隔壁的 ALP 那门课才是正经讲大模型,这里只是个高空俯瞰。听到一半我反而觉得,这种”俯瞰”才是真正值钱的。他把一个被无数公众号、技术博客、...

16 分钟阅读122 阅读
AI 大模型 #AI 模型横评

强化学习这十年,走的是一条不断"删东西"的路

监督学习像一次考试,你答一道题,老师立刻给分。强化学习不是。强化学习是你下一整盘棋,走了几十步,最后才知道这盘赢没赢,而且没人告诉你哪一步是关键的。这个差别看起来只是”反馈给得晚一点”,但它把整套训练范式都拧到了另一...

19 分钟阅读100 阅读
AI 大模型 #MIT《How to AI (Almost) Anything》:多模态 AI 逐讲精读

数据稀缺的模态,要靠别的模态来养

做机器人的人都熟悉一种处境:你想训一个新传感器上的模型,真实数据只有几千条,但同一个场景下,摄像头数据有几百万条、激光雷达数据有几千万条。你眼睁睁看着隔壁模态躺着金山,自己手里却只有沙子。 这不是你一个人的问题。医疗数据、生理传感器、嗅觉信...

16 分钟阅读131 阅读