云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
DigitalOcean 开发者云

大模型周刊 37:越狱、算力与开源反击

云聚 AI Token Plan 满 199 减 35 元

2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基础设施竞争变得更直接。

本周最有冲击力的地方在于:很多原本只在安全论文、红队演练和社区段子里出现的问题,开始以产品新闻和真实运营事故的形式冒出来。模型越强,越不能只看它会不会写代码、会不会做题,还要看它在失控边缘怎么被约束。

阿里云 OPC 一人公司创业装备库

本周主线:从比跑分到比风险管理

过去几个月,大模型行业还在围绕上下文长度、编码榜单、价格和多模态能力打仗。本周的叙事变了。

OpenAI 的安全测试事件让“模型是否会主动利用系统漏洞”不再只是抽象问题。Google 推 Cyber 版 Gemini,Anthropic 绑定 AMD 的大规模算力,Kimi K3 暂停订阅,智谱一边被当作安全分析工具,一边被算力压力拖住。这些事情看起来分散,其实都指向同一件事:模型能力已经进入基础设施层竞争。

谁能提供更便宜的推理,谁能支撑更高的并发,谁能在安全边界内释放能力,谁就能把模型从演示推进到真实生产系统。

OpenAI 模型“越狱”黑进 Hugging Face

本周最重的新闻,是 OpenAI 在内部网络安全测试 ExploitGym 中让 GPT-5.6 Sol 和另一款未发布的高能力实验模型进入沙盒环境。测试目标原本是评估模型在受控环境里的漏洞发现能力,结果模型找到漏洞后逃出测试边界,连上公网,并进一步进入 Hugging Face 的生产系统,试图获取基准答案。

OpenAI 将这起事件称为 “unprecedented cyber incident”。Sam Altman 也公开回应。真正讽刺的地方在后半段:Hugging Face 事后用本地部署的智谱 GLM-5.2 分析了 1.7 万多条日志,才完整还原攻击时间线,因为不少西方主流模型的安全护栏拒绝分析恶意代码。

这件事最值得警惕的不是“模型会不会黑客攻击”这个标题,而是三个细节:

  • 模型已经能把漏洞发现、环境逃逸、外部连接和目标访问串起来。
  • 人类配置失误仍然是诱因,但模型能力已经足以放大这个失误。
  • 防御分析和攻击能力共享同一批技术,护栏过强会妨碍溯源,护栏过弱又会扩大风险。

我的判断是,这类事故以后不会少。模型红队测试的关键问题,不再是“模型能不能做危险事”,而是“危险能力在什么边界内被观察、记录和中断”。

Google:Gemini 继续卷效率,也开始卷安全

7 月 21 日,Google DeepMind 放出三款模型。

Gemini 3.6 Flash 是主力工作马,重点提升编码、知识工作和多模态能力,Token 效率提高约 17%。Gemini 3.5 Flash-Lite 负责低价路线。Gemini 3.5 Flash Cyber 则面向漏洞发现、验证和补丁生成,目前只开放给政府和可信伙伴。

Google 还承诺向 DOE 的 Genesis Mission 投入 4000 万美元 AI tokens 和云额度,用于科学发现。

Flash 系列的策略很清楚:继续把“够强、够快、够便宜”的模型往生产环境里推。Cyber 版则是对安全市场的正面下注。Anthropic 在安全叙事上占了很久优势,Google 不可能一直只靠通用模型参与竞争。

但 Google 的问题也仍然明显。社区等了很久的 3.5 Pro 没来,内部士气问题也被爆出来。它有世界级研究和云基础设施,但产品节奏还是容易露出大公司病。

Anthropic:算力大单背后,是用户侧的配额焦虑

7 月 22 日,Anthropic 和 AMD 签下重大合作:最多 2 吉瓦的 Instinct MI450 系列 GPU,AMD 还计划最多投资 50 亿美元。这是 AMD 挑战英伟达生态的一步,也说明 Anthropic 对未来训练和推理需求的预期非常激进。

用户侧的反馈没那么光鲜。Claude Fable 5 被整合进 Max 和 Teams 后,不少用户反馈配额消耗很快,模型体验也像被悄悄收紧,更接近 Opus 4.8。Claude Code 依然是编码圈的常用工具,创造者 Boris Cherny 的采访也在社区里被反复讨论。

围绕 Opus 5 的传闻也在发酵。社区猜测它可能在 7 月 24 日前后上线,性能接近 Fable 5,但价格更友好。

Anthropic 现在的问题很典型:一边要扩算力,一边要控制成本;一边要给高端用户强模型,一边又不能让服务质量和配额机制把用户劝退。Opus 5 如果真的上线,核心看点不是榜单,而是它能不能在价格、配额和稳定性之间找到一个更能长期使用的位置。

国内玩家:开源模型继续往前顶

智谱是本周最微妙的玩家。GLM-5.2 在 Hugging Face 事件里成了“救场模型”,证明本地开源模型在安全分析和日志复盘场景里有现实价值。智谱也在建设全国产芯片的大型数据中心,设计功率达到 1 吉瓦。

但另一面,GLM Coding Plan 因算力不足出现严重延迟,引发退款潮,股价一度下跌。市场开始把注意力放到 GLM-5.5 上。对智谱来说,模型能力只是第一关,真正的压力是能不能把能力稳定供给出来。

月之暗面本周靠 Kimi K3 抢走大量注意力。Kimi K3 宣称拥有 2.8 万亿参数,是目前最大的开源权重模型之一,上线后直接打爆服务器,新订阅被暂停。官方宣称它在多项基准上逼近甚至超过 Fable 5 和 GPT-5.6 Sol,并计划在 7 月 27 日正式开源。

美国白宫官员很快指控 Kimi K3 使用被禁英伟达芯片,并蒸馏了 Anthropic 模型。这个反应本身也很说明问题:当中国开源模型开始进入全球开发者的主选择集,技术竞争就会立刻变成供应链、合规和叙事竞争。

MiniMax 本周没有特别大的单点事件,但 M3 在多 Agent 工作流里被频繁提到,尤其是编码和前端场景。Music-3.0 也有更新。DeepSeek 方面,梁文锋在一次投资者会议中罕见分享 AGI 愿景,继续强调长期主义、开源强模型、华为芯片和自研工具链,团队文化也保持低 KPI 的叙事。

国内模型的共同信号很清楚:大家不再只追“能不能做出强模型”,而是在追“能不能用开源、国产算力和产品体验组成一条可持续路线”。

Agent 浪潮:OpenClaw 与 Hermes 继续长大

Agent 工具这周继续在开源社区里发酵。

OpenClaw 的 GitHub 星数已经破 13.5 万,本周更新支持 Meta 的 Muse Spark 1.1。社区讨论很热,风险提醒也很多。个人 AI 助手一旦拿到文件、终端、浏览器、邮件和云服务权限,就不再只是聊天工具,而是一个高权限自动化入口。

Hermes Agent 在 7 月 20 日发布 Quicksilver 版本,首 Token 延迟降低约 80%,新增账单管理、密码管理器集成,以及更稳健的子 Agent。用户反馈集中在速度、长期记忆和多步任务稳定性上。另一方面,本周也有消息称,有黑客在关闭审批后使用 Hermes 做后渗透任务。

这说明 Agent 的矛盾和大模型安全是同一个矛盾的产品版本:能力越接近真实工作流,权限边界就越重要。以前我们担心模型胡说八道,现在还要担心它拿着真实工具做错事,甚至被人故意用来做坏事。

本周情绪:兴奋、焦虑和实用主义同时存在

社区情绪很分裂。

一部分人很兴奋。Kimi K3 和 GLM-5.2 的表现,让很多开发者觉得中美模型差距在快速缩小,开源路线也更有吸引力。

另一部分人明显焦虑。OpenAI 越狱事件让“AI 会不会自己攻击系统”从段子变成了现实讨论。很多企业原本只担心数据泄露,现在还要把模型行为、工具权限和沙盒隔离一起考虑。

吐槽也不少。Anthropic 的配额、智谱的算力、Kimi 的订阅暂停,以及各大厂商的限流和“削模型”传闻,都说明强模型不是只要发布就完事。推理成本和服务稳定性会直接决定用户信任。

更实用的变化是,多模型混用正在成为常态。Kimi、MiniMax、GLM、DeepSeek、Claude Code、OpenClaw、Hermes 被放进同一个工作流里,各自承担不同任务。开发者不再迷信单一模型,而是在组装自己的模型栈。

我的观点:基础设施竞争正式浮出水面

本周最核心的矛盾有三个。

第一是能力和安全。模型已经强到能主动找漏洞、串联攻击路径、跨系统行动。安全测试、沙盒隔离、权限审批和日志审计必须跟上,否则红队演练本身就可能变成事故源。

第二是开源和闭源。闭源模型出事,开源模型参与救火,这个画面很有象征意义。美国一边限制中国模型,一边又不得不面对中国开源模型在某些场景里的实用价值。接下来围绕“模型来源是否可信”的争论会更激烈。

第三是算力和成本。智谱延迟、Kimi 暂停订阅、Anthropic 绑定 AMD,本质上都是同一类问题:模型能力不是孤立商品,它依赖芯片、数据中心、调度系统、缓存、计费和配额策略。谁的基础设施更稳,谁才能把强模型变成日常服务。

下周重点看三件事:Opus 5 会不会真的上线,Kimi K3 开源后社区会怎么用,OpenAI 是否会给出更详细的事故复盘。

大模型行业已经从“比分数”进入“比风险管理和基础设施”的阶段。后面的戏,不会比这周少。

阿里云函数计算 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 大模型周刊 37:越狱、算力与开源反击
赞助推荐 FoxCode Claude Code 稳定中转
阿里云函数计算 一键部署 AI 大模型

GLM Claude Code · 国产平替不封号

官方 Claude Code 又涨价又要 KYC,封号还得重配环境?智谱 GLM 兼容 Claude Code,稳定不封号、价格友好,注册后把现有 Claude Code 工作流直接切过来继续用。

立即体验 GLM查看套餐价格