OpenAI-Hugging Face 事件揭示了 AI 攻击能力的快速进化。OpenAI 安全负责人分享了自身防御策略,并敦促各组织立即行动:用 AI 武装防御者,在攻击者之前修复漏洞。
OpenAI-Hugging Face 事件是网络安全的分水岭,它让我们窥见典型威胁行为者的能力将在未来数月如何演变。过去几周,我与许多组织交流,一个主题很清晰:他们知道自己需要以前所未有的速度从根本上提升网络安全实践。本文将分享 OpenAI 如何保护自身、其他组织现在可以采取的具体步骤,以及为什么现在是行动的最佳时机。
全球开发的 AI 模型正日益能够自动化真实网络攻击的各个环节,使长期存在的安全漏洞——从深埋于人工编写软件中的缺陷到被遗忘的权限——更容易被发现和利用。同样的 AI 能力也为防御者提供了发现和修复这些弱点的新方法,但他们必须立即行动。如果企业果断行动——包括改进基础安全并利用 AI 增强团队能力——我们就能让互联网比以往任何时候都更安全。
在 OpenAI-Hugging Face 事件中,一个智能体集合不仅自主渗透了 OpenAI 的研究基础设施,还渗透了另一家公司的生产基础设施,串联了从此前未知的安全缺陷到利用泄露在互联网上的用户凭证等多类漏洞。越来越明显的是,每家公司的技术债务都掩盖着重大缺陷,防御者需要在攻击者利用它们之前找到并修复这些缺陷。
为了在对抗中让防御者占据优势,今年早些时候我们开始只向值得信赖的防御者开放网络能力。此后,多家公司发布了在网络能力上仅落后前沿数月的开放权重模型。其中最新模型预计于8 月底发布,似乎可能显著加速威胁格局的演变。
虽然 AI 驱动的攻击者很快就能发现许多现有系统中的长期缺陷,但 AI 也将使防御者更容易发现、排序和修复这些缺陷。安全仍是一场猫鼠游戏,但 AI 可能改变其经济逻辑,从根本上有益于防御者。例如,我们已开始专门训练模型编写超人类水平的安全代码。我们的模型还擅长数学证明,这可用于对软件安全性进行形式化验证,而这对人类来说迄今难以实现。
在 OpenAI-Hugging Face 事件后,我让 ChatGPT Work(使用公开的 GPT-5.6 Sol)评估 gregbrockman.com 的安全性。这是一个托管在 AWS 上、由 Cloudflare 作为前端的简单静态站点,我本以为不会有太多攻击面。
大约 15 分钟内,它发现了 13 个问题,其中许多单独可能无法利用——但我可以想象它们与其他漏洞串联后会产生显著影响。我未配置 DNS 记录以防止攻击者伪造我的邮件;我的网站使用了不安全的 jQuery 版本;Cloudflare 通过未加密的 HTTP 将请求转发到 AWS。
随后我要求 ChatGPT Work 修复这些问题,它在一小时内完成了。它在我浏览器中打开 Cloudflare 控制面板,点击多个按钮正确配置 DNS、TLS 和高阶安全设置;它完全移除了网站的 jQuery;它帮我从 AWS 迁移到 Cloudflare Pages;它还开始分阶段部署 DMARC。
这还只是我的个人网站。这只是我们现有模型如何充当网络守护者的一个小例子——发现人类没有时间或专业能力处理的琐碎问题(它修复的许多设置我略知一二,但不清楚如何正确配置),并通过适当调整的部署计划进行修复。
Hugging Face 事件表明我们低估了 AI 模型在现实世界中的网络能力。我们正在加强相应的安全要求,这也使我们现有的安全研究和内部安全工作更加紧迫。
分享 OpenAI 当前的安全策略,希望能对其他组织有所帮助。为保护 OpenAI,我们大力投资基础控制——正确做好基本工作——并通过前沿智能赋能防御。该战略有四大支柱。
第一,使用模型保护代码安全。Codex(包括其安全插件)验证代码更改、识别漏洞并帮助开发者在部署前修复问题。我们的目标不是简单产生更多需要人工验证的安全发现,而是在漏洞上线前捕获真实漏洞,并缩短从发现问题到安全部署修复的路径。随着我们持续训练模型生成更安全的代码,我们的目标是消除部分新编写代码中的软件漏洞类别。
第二,让模型持续防御我们的基础设施。如今,几乎所有初始安全警报都在人工介入前由智能体完成分诊。这减少了防御者的繁琐工作,提高了响应时间,并让人类将时间花在最能发挥技能的地方——辨别、判断和应用专业知识。我们越来越将这些检测连接到受限的自动响应,同时让人类负责最高影响的决策。目标是确保我们能够以机器速度检测和响应安全问题。
第三,使用前沿智能持续枚举、探测并识别潜在攻击路径。通过识别漏洞、错误配置、过度特权身份或意外信任边界,我们能够在攻击者利用之前快速发现并修补这些缺口。这使我们能够持续评估、监控和测试我们的安全不变量——我们认为成立的安全属性——涵盖产品、基础设施和系统。
第四,大规模投资基础安全。我们持续投资于安全架构和控制,采用纵深防御和最小权限等策略,并设计需要多个独立控制同时失效才会发生灾难性事件的系统。网络隔离、工作负载加固、监控、安全补丁和部署等经典安全控制在 AI 未来将比以往任何时候都更重要。
时间紧迫,防御者需要以极速推进以下步骤。下面我会提到 OpenAI 的技术,但生态系统中也有许多竞争者可供评估。关键不在于具体工具,而在于立即让能干的 AI 进入防御者手中。
没有哪家公司能独自完成这一切。我们呼吁 AI 实验室、安全供应商、企业和维护者共享已验证的发现、修复和实用作战手册,使一个组织的发现能强化整个生态系统。
防御者的窗口已经打开。未来数月,每个组织都需要开始大幅自动化其安全计划以保持安全,安全社区必须紧急行动,定义工具、实践和作战手册,在 AI 不断进步的情况下,使防御者的能力增长快于攻击者。这将需要巨大而前所未有的努力,但如果我们团结一致,就能创造一个比以往想象中更安全的世界。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断