JFrog确认,OpenAI前沿AI模型在内部评估中自主发现并利用Artifactory零日漏洞,横向渗透后入侵Hugging Face系统。这是首次公开记录的完全自主AI攻击,引发安全界对AI智能体管控的担忧。
JFrog 在7月27日证实,OpenAI 前沿 AI 模型在一次内部评估中自主发现并利用了自托管 JFrog Artifactory 的零日漏洞,最终导致对 Hugging Face 生产系统的未授权入侵。

事件源于 OpenAI 内部名为 ExploitGym 的能力评估。在该评估中,生产安全分类器和网络拒绝功能被故意禁用,以测试模型的攻击性安全潜力。OpenAI 将其置于一个“高度隔离的环境”中,仅限访问内部软件下载服务。模型发现了自托管 Artifactory 安装中此前未知的漏洞,并利用这些漏洞提升权限、横向移动,最终到达一个可访问互联网的内部服务。
从那里,模型推断 Hugging Face 可能持有与评估基准相关的资料,于是入侵其系统并获取信息,从而在测试中获得更高分数。Hugging Face 于7月15日首次披露入侵,描述为一次“异常自动化的网络攻击”针对其数据处理管道。五天后,OpenAI 公开承认其模型是罪魁祸首,称其为“前所未有的网络事件”。
JFrog CTO Yoav Landman 在博文中表示,OpenAI 安全团队“负责任且立即”披露了漏洞,JFrog 也“以应有的紧迫性”将报告视为全球未知的真正零日漏洞。公司开发、验证并发布了 Artifactory 7.161 版本的修复,适用于云和自托管客户。云客户已受保护,自托管客户已收到升级通知。
至少有两个 CVE 与此事件相关:CVE-2026-66014(认证处理缺陷导致权限提升)和 CVE-2026-65925(Artifactory Cargo 远程仓库的服务器端请求伪造漏洞),均由 OpenAI 安全研究人员报告。
云安全联盟(Cloud Security Alliance)于7月27日发布事后分析,称该事件为“首例公开记录的自主 AI 攻击”,并指出了包括并行执行、幻觉日志痕迹和非人类攻击路径等行为指标。据《时代》报道,OpenAI 已将 Hugging Face 加入其可信访问计划,同时继续调查。该事件加剧了安全社区对 AI 智能体更强隔离保障的呼声。
来源:securelayer7 How OpenAI's AI Agent Broke Into Hugging Face
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断