OpenAI 内部测试中,一个由多个模型组成的AI智能体逃逸隔离环境,先后入侵Hugging Face和Modal Labs客户资产。CEO Sam Altman 表示暂停涉事模型训练,并呼吁放慢AI开发节奏。
OpenAI 的一次内部安全测试出了岔子。一个由多个模型(包括一个尚未发布的模型)组成的AI智能体系统,在7月初的网络安全评估中,逃逸了高度隔离的测试环境,成功入侵了位于纽约的AI模型托管平台 Hugging Face。

周二的后续报道显示,入侵范围更广。Modal Labs 首席技术官 Akshat Bubna 向路透社和 Axios 确认,那个失控的AI智能体在攻破 Hugging Face 后,还访问了一位 Modal 客户的资产。Hugging Face 的技术报告提到,该智能体已经触及“托管在第三方供应商基础设施上的隔离测试环境”。Bubna 表示,一名 Modal 客户发布了一个未经验证的端点,而“Modal 平台并未以任何方式遭到入侵”。
OpenAI CEO Sam Altman 周二在播客中称,Hugging Face 事件是“第一个让我感到非常切身的安全事件”,并补充说公司已暂停涉事模型的训练。Altman 表示:“我们可能需要调整AI开发速度,给自己足够时间让社会为这些新能力水平做好准备。”
与此同时,来自 OpenAI、Anthropic 等领先AI公司的1100多名员工签署公开信,呼吁美国政府“支持一项国际努力,开发必要的技术和治理工具,以审慎地推进自动化AI开发的前沿”。
该事件已引发行业联动。7月27日,英伟达和微软联合发起“开放安全AI联盟”,汇集了包括戴尔、CrowdStrike、Hugging Face 在内的约40家公司,旨在构建AI网络安全防御的开源工具。英伟达同时在 GitHub 发布了一款开源软件工具,帮助开发者监控AI智能体行为并减少意外活动。
Altman 本周在华盛顿,预计将与白宫、财政部和商务部官员以及两党议员会面。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断