IT之家 8 月 8 日报道,OpenAI 正式宣布推迟代号为“Astra”的新一代人工智能模型的发布。根据 OpenAI 的《准备框架》,该模型在内部及专家评估中,展现出在智能体编程与网络安全领域的突破性能力,因此被列为首个在网络安全方面达到“关键”(Critical)风险级别的模型。根据该框架定义,AI 模型若满足两个条件之一即触及红线:一是无需人类干预即可在经过安全加固的系统中识别并开发零日漏洞利用程序;二是仅需提供高层级战略目标,即可针对加固目标自主构想并实施全新的端到端网络攻击。OpenAI 特别澄清,Astra 尚未发布,并未参与此前针对 Hugging Face 的网络攻击。为确保安全合规,OpenAI 宣布对高能力模型实施更严格的管控,包括设置隔离测试环境、限制网络访问、实施沙箱化运行以及对思维链进行监控审查,并暂停了内部不满足强化安全标准的 Astra 相关活动。OpenAI 表示将与政府及第三方安全组织合作测试。CEO 萨姆·奥尔特曼强调,虽然 Astra 性能强劲,公司致力于将其公开发布,但鉴于其在网络安全方面的强大能力,需要更多时间确保万无一失。
事件分析
💡 核心观点:当 AI 智能体能力足以独立攻破安全防线,“安全刹车”将成为比“加速引擎”更决定生死的产业命题。
原文链接:Linux.do





