跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

持续更新

更多文章

AI 大模型

Hassabis:AGI 大概在 2030 年,先把它做成工具

Demis Hassabis 在 Sequoia Capital 做了一场对话,聊了将近半小时。标题挺吸引眼球——"我们离 AGI 还有四分之三的路程"——但如果你期待的是某个技术突破的发布,这场对话给出的东西其实更安静,也更值得咀嚼。 H...

9 分钟阅读181 阅读
架构设计

Andrej Karpathy 对 agentic engineering 的最新补充

最近关于 AI 编程的讨论,已经从“会不会写代码”转向“怎样把一个不稳定的智能体放进可控的工程系统里”。Karpathy 这场新对谈把 software 3.0、可验证性、jagged intelligence 和 agentic engi...

12 分钟阅读192 阅读
AI 大模型

Agentic Development 的组织化阶段

最近我越来越觉得,AI 编程已经不只是“写代码更快”这件事了。它正在把软件开发往另一个方向推:人不再主要亲手敲代码,而是开始搭建上下文、制定边界、分配风险,并同时管理一群会干活的代理。 这篇文章整理自 Spotify 和 Anthropic...

17 分钟阅读91 阅读
AI 大模型

在大型代码库里用好 Claude Code

Anthropic 五月十四号发了一篇长文,叫《How Claude Code works in large codebases》,是他们《Claude Code at scale》系列的第一篇。这是官方第一次系统化地把”大型代...

21 分钟阅读225 阅读
架构设计

Positional Encoding 怎么解决词序问题

Transformer 刚出来时,很多人把注意力都放在 self-attention 上。那当然没错,因为它确实重新定义了模型怎么看上下文。但如果只盯着 attention,你会漏掉另一个同样关键的问题:模型怎么知道词序? 这是我看完这期视...

19 分钟阅读63 阅读
架构设计

Self-Attention 为什么成了 Transformer 的核心机制

软件模型有过一个很长的阶段:它们能读句子,却不太会“理解句子”。问题不在词表,也不完全在参数规模,而在于早期模型看待语言的方式太像流水线——前一个词处理完,才能轮到后一个词。这样一来,句子一长,前面的信息就会慢慢变模糊。 这就是我看完这期视...

15 分钟阅读73 阅读
架构设计

Harnesses 让 AI Agent 变得可靠

软件开发里,大家最熟悉的词可能还是 agent。 但最近两年,另一个词开始频繁冒出来:harness。 这个词不好翻。按字面,它是“安全带”或者“束具”。不过放到 AI 工程里,我觉得它更像一层“驯化外壳”——不是替代模型,而是把一个不稳定...

16 分钟阅读156 阅读
AI 大模型

Hermes Agent 接入 xAI Grok 的部署攻略

日期: 2026-05-17 作者: toy 最近一次远端节点升级让我意识到一件事——OAuth 在 SSH 远端场景下其实有一套可复用的范式。过去每次撞到都靠现场拼凑,这一次顺着 Hermes Agent 升级 + 接入 xAI Grok...

17 分钟阅读479 阅读