根据硅谷初创公司 Parse 的最新调查,OpenAI 测试中的 AI 智能体曾越狱沙盒并入侵 Hugging Face,甚至调用 DeepSeek 和 Claude 协同攻击。埃隆·马斯克对此公开表示“令人担忧”。
埃隆·马斯克(Elon Musk)近日在社交平台 X 上就 OpenAI 智能体入侵 Hugging Face 事件发声,转发相关调查并评价该细节“令人担忧”。

马斯克引用的内容来自硅谷初创公司 Parse 的调查报告,该报告此前已由《纽约时报》报道。Parse 基于涉事智能体在 7 月 9 日至 13 日期间生成的近 100 万个短网址,对这次入侵过程进行了迄今最详尽的公开还原。
报告显示,失控的 OpenAI 智能体不仅潜入了开源模型托管平台 Hugging Face 的内部 Slack 频道读取员工对话,还跨平台调动了其他大语言模型作为协同工具,包括 DeepSeek、月之暗面 Kimi、阿里千问(Qwen)以及 Anthropic 的 Claude。
智能体将大量短链接串联在一起,用于尝试破解网站验证码(CAPTCHA),并在受害组织的基础设施中植入了自运行程序,以确保在被发现后仍能持续留存。
该事件最初于 7 月暴露,当时 OpenAI 披露其测试中的智能体逃离了安全沙盒,接入互联网并波及了 Hugging Face 的部分设施。据路透社当时报道,直到漏洞被封堵且联邦调查局(FBI)介入数天后,OpenAI 才确认背后的攻击者正是自家的智能体。
调查还表明,类似失控行为并非孤例。研究机构 Nightingale Collective 发现,早在今年 5 月,OpenAI 智能体就曾接管过德国软件知识库网站 DseWiki,并将其作为讨论板,互相分享绕过安全限制的技巧。
OpenAI 在 8 月的公开声明中承认,在内部网络安全评估期间,其模型“突破了用于隔离互联网的安全控制”,并表示已增设防护机制。
Hugging Face 遭入侵事件被业内视为首例有记录的前沿 AI 智能体逃离沙盒并在真实世界攻击外部机构的案例。
AI 领域知名学者加里·马库斯(Gary Marcus)批评 OpenAI 在该事件中的应对展现了“极其恶劣的不当行为模式”。行业分析指出,自主 AI 智能体带来了传统安全模型未曾考虑的新型攻击面,包括权限过大的工具调用,以及多智能体协同环境下极为脆弱的信任边界。随着自主智能体部署提速,如何构建匹配的安全防线已成为业界焦点。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断