别急着整理知识库:先让 Agent 有足够的“原材料”可吃
很多人搭知识库,第一步就开始设计目录、标签和模板。结果通常是:系统越来越漂亮,笔记越来越少。 Warp 开发者关系负责人 Ben Holmes 在一场分享里给出的顺序很反直觉:先别整理,先把想到的东西尽可能留下来。等原材料积累到一定规模,再...
持续更新
很多人搭知识库,第一步就开始设计目录、标签和模板。结果通常是:系统越来越漂亮,笔记越来越少。 Warp 开发者关系负责人 Ben Holmes 在一场分享里给出的顺序很反直觉:先别整理,先把想到的东西尽可能留下来。等原材料积累到一定规模,再...
AI 个人订阅只需要看两组对标:**ChatGPT Plus 对 Claude Pro,ChatGPT Pro 对 Claude Max 5× / Max 20×**。放在一张总表里,价格和额度关系会清楚很多。 月金额按一年 52 周折算:...
一个任务投送系统出现过两种症状。待执行任务进入 Kafka 的速度不够,数据库也频繁出现锁等待。两种症状来自同一段调度代码。 旧流程用一个线程逐条发送任务。整批投送又共用一个数据库事务。前面的任务已经改过状态,却要等批次尾部的任务发送结束。...
AI 竞争已经打到了第三层。第一层拼基础模型——GPT、Claude、Gemini 谁更强;第二层拼 Agent——Codex、Claude Code、Trae 谁更好用。DeepSeek 上周扔出一件新东西,直接把战场拉到了第三层:Har...
过去一年里,”让 AI 写测试优先”几乎成了 AI 编程的政治正确。绝大多数被传播的 CLAUDE.md、AGENTS.md、.cursorrules 里,都能找到一句”先写失败的测试,再写实现̶...
本周大模型圈最重要的信号不是又多了几个新模型,而是后训练、Agent能力和开源可用性同时加速。智谱、DeepSeek、Google、OpenAI和Anthropic都在用不同方式回答同一个问题:模型怎样从会聊天变成能稳定干活。
本文整理自「灵姐说AI」对 WorkBuddy、Kimi Work、千问办公和 TRAE Work 的同题实测。真正值得看的不是谁的界面更像 Codex,而是工作 Agent 进入日常流程后,什么才算可验证、可追责、可直接使用的交付。原视频...
本文整理自 OpenAI Dominik Kundel 在 AI Engineer World’s Fair 的演讲。它真正值得看的地方,不是 Codex 又多了几个功能,而是 OpenAI 正在把 coding agent 的关键能力从“...
如果最近一轮 Claude 封号潮把你赶出了个人订阅,这个标题可能很有画面感:一家南洋公司开始“招聘 Claude 难民”,月薪没有,工位费倒是每月 275 元。 这里的“招聘”当然不是劳动合同,而是加入一家新加坡公司的 Claude Te...
2026 年 8 月第一周没有新的旗舰模型炸场,但产品下沉、企业合规、开源视频、Agent 基础设施和融资动作都在加速。真正的主线越来越清楚:大模型竞争正在从参数规模,转向稳定、便宜、可控地交付工作流。 上半月的余温还在。OpenAI 继续...
Jason Liu 在 AI Engineer 的这场 Codex 工作坊,表面是在讲 appshots、skills、plugins、memory、automation 和 computer use,实际讲的是一个更大的转向:Agent ...
2026 年 7 月最后一周,大模型行业的主线很清楚:美国头部厂商用降价和生态补强防守,中国开源阵营继续用权重开放和性价比抢开发者心智,Agent 与具身智能开始从概念走向生产场景。
有人在搜索框里反复打 freemodel 这个词。需求还是那个老需求:想用 Claude Code,但官方订阅要美区信用卡,价格也压手,于是去找中转站。 FreeModel.dev 是最近冒出来的一个,口号喊得很大——”One ...
2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GL...
Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness ...
Tesla 机器学习工程师 Ishita Daga 在这段 12 分钟分享里,把企业数据 Agent 的失败原因压到三个词:歧义、腐败、偏好。本文结合我自己的 Harness / 企业记忆笔记,讨论为什么加模型、加上下文、加知识库都不是根治...
本文整理自 Google DeepMind 工程师 Philipp Schmid 在 AI Engineer 的演讲。核心问题不是 Skill 有没有用,而是没有 eval 的 Skill 无法判断何时该触发、何时该退休,也无法证明它真的让...
第37期大模型周报,记录2026年7月11日至17日这一周的几个关键信号:OpenAI把GPT-5.6推向企业代理,Anthropic继续押注开发者生态,Google走企业集成路线,中国开源模型则用Kimi K3和GLM系列把成本压力重新打...
本文整理自 BridgeMind 对 Kimi K3 的一次上手测试:它不再只是便宜替代品,而是开始在 UI 设计、全栈应用生成和真实 agentic coding 任务里挑战闭源前沿模型。原视频:https://www.youtube.c...
Peter Yang 这期视频展示了 GPT-5.6 发布后,ChatGPT 桌面端如何从聊天工具变成管理邮件、日历、播客准备和网站发布的个人操作系统。这不只是一个工具教程,更是一套 AI 时代工作方式的落地样本。 Peter Yang 这...