
大模型周刊 37:越狱、算力与开源反击
2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

Erik Meijer 的 “In Code They Act, In Proof We Trust” 是当天最硬核的一场。他把 agent 安全从 prompt、policy 和 “模型应该学会对齐...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。

Daksh Gupta 代表 Greptile 分享了对一百多万个 AI 生成 PR 的分析。这是当天最接近工程现实的一场,因为它不是 demo,而是大量 PR 经过 review 后留下的数据。 原视频:https://www.youtu...

上周五,美国政府做了一件很反常的事:它逼着本国最领先的一家 AI 公司,把最先进的产品从市场上撤下来。首当其冲的是 Anthropic,它的前沿模型叫 Mythos,对外卖的那个版本叫 Fable。据报道,留给公司执行的时间,大约只有九十分...

我先给一种失败模式起个名字:隐性失败。没有报错,没有警告,没有任何异常提示,你拿到的只是一个错答案。 这是 Bright Data 的 Rafael Levi 在 AI Engineer 大会上一场演讲的主题。他做的是帮 agent 大规模...
— title: “Security is not a vibe. It is a proof.” date: 2026-06-07T09:00:00 — Relying on a seman...
— title: “Security is a power draw, not just a packet filter” date: 2026-06-05T09:00:00 — Networ...
— title: “Credential Policy Belongs in the Tool Router, Not the Prompt” date: 2026-05-27T09:00:00 R...

作者:toy | 覆盖周期:2026.5.9 – 2026.5.15 本周三件事值得拎出来单独讲:Anthropic 的 Claude Mythos Preview 把”AI 能不能找零日”这个老问题往前推了一大步;...
近日,部分技术社区用户反馈 ChatGPT 账号出现大规模 401(Unauthorized)未授权...