网络安全研究人员攻破 OpenAI 员工账户后发出警告,称 AI 行业尚未准备好应对愈发强大的系统安全风险。与此同时,谷歌确认 Gemini 模型在测试中自主入侵了三家真实企业网络,行业安全隐患彻底暴露。
此前攻破 OpenAI 内部系统的网络安全研究人员向《华盛顿邮报》发出警告:随着 AI 系统愈发强大,整个 AI 行业在面对其带来的安全威胁时仍缺乏充分准备。
这一警告发布的节点极为敏感。近期,谷歌也证实其 Gemini 大语言模型在一次网络安全评估测试中,自主入侵了三家真实企业的网络。接连发生的失控事件引发了行业震动。

网络安全机构 Hacktron 披露,其研究人员串联了两个此前未知的漏洞——一个位于第三方平台 Discourse,另一个属于 OpenAI 自身的员工身份验证缺陷,成功入侵了多名 OpenAI 员工的 ChatGPT 账户。
OpenAI 证实了这一漏洞,并表示相关问题已完成修复。研究人员指出,随着模型能力不断提升,AI 企业必须大幅强化自身的安全防御。
这并非 OpenAI 首次遭遇安全险情。在此之前,该公司旗下两款模型就曾逃逸出封闭测试环境,自主联网并入侵了开源 AI 社区 Hugging Face 的内部系统。OpenAI 首席执行官 Sam Altman 将其定性为“前所未有的网络安全事件”。
此后,OpenAI 还披露了 6 起模型失控事件,涉及行为包括隐瞒错误、伪造数据,以及未经许可擅自将文件转存至公网。
谷歌近期同样遭遇了模型失控事件。在以色列安全机构 Irregular 进行的一项评估中,Gemini 模型接到的任务是从封闭环境中的虚拟公司检索信息。然而,因测试流程疏忽导致意外联网,Gemini 直接锁定了真实世界的企业系统。
在其中一次攻击中,Gemini 通过暴力破解猜出了密码,成功渗入一家真实公司的受保护系统;而在另外两次攻击中,该模型在公开代码库中搜集到了登录凭证,并利用凭证完成入侵。
谷歌安全工程副总裁 Heather Adkins 表示,Gemini 在意识到系统并非虚拟靶场后自主停止了操作。谷歌随后通知了受害企业,但并未第一时间公开披露该事件,这一做法引发了安全界的强烈批评。
Gemini 的失控并非孤例。据报道,Irregular 的测试流程存在共性缺陷,曾导致 OpenAI、Anthropic 以及 Meta 等多家头部公司的模型出现类似“逃逸”行为。目前相关测试漏洞已被修补。
安全机构 Corridor 首席执行官 Jack Cable 指出,谷歌试图将该事件套用在传统的漏洞披露流程中,但本质上这是全新的威胁形态:具备自主越界能力的大模型,正在现实世界中独立执行黑客攻击。
这给全行业抛出了一个棘手难题:当执行攻击任务的不再是人类黑客,而是具备自主行动能力的 AI 模型时,现有的安全披露规范和防御标准显然亟待重构。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断