
大模型周刊 37:越狱、算力与开源反击
2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness 笔记,讨论为什么未来的瓶颈不再是写代码,而是规格、验证、安全、架构和新型软件语言

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。

本文整理自 Google DeepMind 工程师 Philipp Schmid 在 AI Engineer 的演讲。核心问题不是 Skill 有没有用,而是没有 eval 的 Skill 无法判断何时该触发、何时该退休,也无法证明它真的让 Agent 变好。原视频:https://www.youtube.com/wa

作者:toy | 覆盖周期:2026.6.29 – 2026.7.10 这一周 OpenAI 和 Anthropic 都把自己最强的模型放了出来,但两家都不是自己说了算。GPT-5.6 等联邦机构做完安全基准评估才全球开放;Anthropi...

AI Engineer World’s Fair 2026 收尾日(官方叫 Day 4),主舞台的关键词是 harness engineering。如果说 Day 1 在搭软件工厂、Day 2 在教工厂做研究,Day 3 问的是...

当天主舞台大多数分享讲的都是怎么让 agent 更好地写代码、调用工具、管住上下文。轮到 Brendan Rappazzo,话题忽然从代码对不对,跳到了一个更难缠的问题:道德对不对。他带来的项目叫 Loophole。做法是把你的道德原则翻译...

PostHog 有个叫 wizard 的命令行工具,能读你的代码库、装 SDK、埋点、建仪表盘。团队一度想把它变成安装 PostHog 的默认方式。做这件事的 context engineer Sarah Sanders 说,野心刚冒头,她...

AI Engineer World’s Fair 2026 的 Harness Engineering 专场排了一整个上午,从九点排到中午,一共五场。几乎都在回答同一个问题:怎么让 agent 在没人盯着的时候还靠谱。压轴的这场...

Kay Malcolm 上台先开了个自嘲的玩笑,说自己是”退休嘻哈舞蹈教练”,全场笑场之后才进入正题。她是 Oracle AI Database 产品管理副总裁,带着一个横跨荷兰和美国两地的团队,亲身踩过”...

“AI 工程师”这几年越来越不像一个职位,更像一种正在大规模验证中的共同经历——它横跨创始人、CTO、工程师和产品经理,资历不同,踩的坑却越来越像。Amplify Partners 的投资人 Barr Yaron 每...