
AI Engineer 2026 第二天讲的是自动研究
Day 2 topic overview 这场分享来自 AI Engineer World’s Fair 2026 Day 2 主舞台,讲者是 Main Stage。本文只整理会议内容和分享脉络,不做个人使用心得。 原视频:ht...

Day 2 topic overview 这场分享来自 AI Engineer World’s Fair 2026 Day 2 主舞台,讲者是 Main Stage。本文只整理会议内容和分享脉络,不做个人使用心得。 原视频:ht...

做过 RAG 或者 Agent 的人,多半都卡在同一个地方:模型本身很聪明,但你喂给它的网页数据脏得没法看。 随便抓一个现代网页,原始 HTML 里塞满了导航栏、广告位、cookie 弹窗、内联脚本、追踪像素和层层嵌套的 <div&g...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。

TL;DR 写过几个 LLM 应用的人多半都经历过同一条曲线:第一版是几行脚本,prompt 拼好、调一次模型、打印结果,跑通了很开心。等到要做多轮对话、要带记忆、要在某一步插入人工审批、要在出错后从中间继续——那几行脚本就开始膨胀成一团互...

如果你正在搜「Codex 最佳实践」,大概率已经过了「怎么装、怎么跑第一条命令」这一关。你能让 Codex 改一个函数、修一个 bug、跑一段脚本,但越用越有种说不清的别扭:同样一句话,有时候它一击命中,有时候它绕了一大圈还把不该动的文件改...

很多人最近在搜索框里反复打”Claude Max 5x 还是 Codex Pro 5x”,背后其实是一个很现实的预算问题:两边的中高档订阅月费都卡在 100 美元这条线上,每月只想付一份钱,到底该把这 100 美元交...

TL;DR:先把结论摆出来 如果你已经在用 Codex 写代码,又被”它能读代码、却始终不懂这个项目”折磨过,那 codex-brain 想解决的就是你的痛点。 它是什么:codex-brain 是开源项目 Proj...

2026 年上半年,”自主 AI Agent”这个词从概念变成了两个能真正下单买来用的产品:Anthropic 在 1 月发布的 Claude Cowork,和已经迭代一年多的通用自主代理 Manus。两者都宣称能&...

每隔一段时间就会有人在群里问:现在写代码到底用 Trae 还是 Cursor?前者是字节跳动推出的 AI 原生 IDE,价格便宜得不像话,中文体验顺滑;后者是海外用了一两年的老牌选手,自研模型、Agent 闭环都更成熟。两边都基于 VS C...

很多人最近搜 “Claude Cowork 和 Claude Code 区别”,是因为名字太像了:都带 “Claude”,都被叫 “agent(代理)”,都能在你的电脑...

Claude Code 的用量问题,最容易被算错。 很多人只看月费:Pro 便宜,Max 5x 更贵,Max 20x 最贵,ReClaude 或拼车看起来又是另一套价格。这样算没有错,但不够用。 真正影响成本的不是月费本身,而是你一天跑多少...

Claude Code Pro / Max 的支付问题,表面是“怎么付钱”,实际是“用什么身份和地区长期付钱”。 如果只是开通一天,办法很多:信用卡、Apple ID、Google Play、礼品卡、虚拟卡、低价区、代充,都可能在某个时间点...

Claude Code 封号最误导人的地方,是它看起来像单点事故。 有人会说是 IP,有人说是信用卡,有人说是 KYC,有人说是第三方中转,有人说是 Claude Code 用太猛。每个说法都有真实案例,但如果只抓一个原因,很容易得出错误结...

如果只看能力,Claude Code 仍然是我现在最愿意放进工程流里的 AI 编程工具。它读仓库、改代码、跟踪上下文、解释错误和做小范围重构时,仍然比很多替代品顺手。 但订阅值不值得买,不能只看模型能力。对重度用户来说,真正的问题已经变成:...

很多人搜「claude desktop 中文」,心里其实有两个并列的问题:一是想找一份能照着做的中文安装与使用教程,二是想知道这个桌面客户端到底能不能切成简体中文界面、能不能用中文跟它对话。 这两件事的答案不一样,而且必须先讲清楚,否则你会...

TL;DR: 多工具时代, skill 不该各管各的 如果你同时在用 Claude Code、Codex、openclaw、hermes 这类 agent 工具, 大概率已经踩进同一个坑: 同一套”让 agent 怎么提交代码&...

作者:toy | 覆盖周期:2026.06.20 – 2026.06.26 这一周,OpenAI 有三件事砸在同一个窗口里:6 月 24 日和博通一起亮出第一颗自研芯片 Jalapeño,6 月 25 日被白宫要求把新模型 GPT-5.6 ...

有人在搜索框里反复打”1m 上下文已经全量可用”。这背后不是想读一篇科普,而是一个很具体的工程疑问:我现在用的模型,到底是不是已经能吃下 100 万 token 的上下文?如果能,我该不该把整个仓库、整本手册、整批日...

社区里流传一句很有冲击力的话:某个项目把 Claude Code 的「准确率从 41% 升到 89%」,靠的只是改了一个 CLAUDE.md。这个数字来自热点原帖的说法,没有公开的评测方法和样本量,我们不把它当作实测基准。但它指向的那件事是...

“Codex 会把磁盘给烧了吗?” 这句听上去夸张的吐槽,背后其实是一个很现实的问题: 当你把一个能自己读写文件、跑命令、装依赖、起容器的自主编程 agent 放到本地长时间运行,它确实有可能在你不注意的时候把磁盘占...

TL;DR 一句话定义:vibe coding 想到哪写到哪,靠语义直觉驱动模型补全;spec coding 先写规格、定接口和验收,再让模型按规约实现。前者原型阶段真的快,后者在三天后你还认得自己代码这事上无可替代。 长项目的分水岭只有一...