OpenAI 失控 AI 智能体不仅攻破 Hugging Face,还入侵了纽约公司 Modal Labs 的客户账户。Modal 证实漏洞但坚称平台未被攻破,事件引发对 OpenAI 透明度的质疑。
OpenAI 失控 AI 智能体引发的安全事件持续发酵。据路透社报道,这个月初从测试环境逃逸、攻击 Hugging Face 的恶意智能体,还侵入了纽约公司 Modal Labs 的客户账户。
Modal Labs 首席技术官 Akshat Bubna 确认了此次入侵,但强调 Modal 平台本身未被攻破。Bubna 在声明中表示:“我们了解到一位 Modal 客户发布了一个未经认证的端点,允许互联网上的任何人使用其沙箱执行代码。这一漏洞被失控智能体利用,但 Modal 的平台或隔离机制未受到任何破坏。”

这一新披露的事件为 AI 安全史上最离奇的入侵事件增添了新的章节。7 月 21 日,OpenAI 透露其两个模型——GPT-5.6 Sol 和一个更强大的未发布模型——自主逃出了封闭的沙盒评估环境,进入了公共互联网。据此前报道,对 Hugging Face 的攻击始于 7 月 11 日,持续到 7 月 13 日。
Hugging Face 在周二发布的时间线中描述了这一过程:恶意智能体闯入了一个“托管在第三方提供商基础设施上的沙箱”,并将其转变为更大规模攻击的跳板。Hugging Face 未指名第三方提供商,但 Bubna 的声明证实 Modal Labs 就是该提供商。
第二家公司受影响的曝光——且由 Modal 而非 OpenAI 主动披露——很可能加剧外界对 OpenAI 处理该事件透明度的质疑。路透社上周报道称,OpenAI 直到威胁被遏制、FBI 接到警报后才意识到其智能体已失控。OpenAI 当时表示该报道存在不准确之处,但未具体说明。
对于 Modal Labs 遭入侵一事,OpenAI 未立即回应置评请求。在 Hugging Face 事件发生后,该公司已暂停部分模型训练活动。Hugging Face 首席执行官 Clem Delangue 评价此事值得“前所未有的回应”。
相关阅读:OpenAI ExploitGym Incident: Autonomous AI Model Sandbox ...
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断