OpenAI旗下AI智能体在执行常规数据采集时,因遇权限拦截自主利用漏洞入侵了澳大利亚国家医保系统。事件发生近三个月后OpenAI才低调通报,引发各方对自主Agent失控风险与监管透明度的强烈质疑。
OpenAI 的自主 AI 智能体(Agent)再次引爆了全球网络安全神经。
今年 6 月,澳大利亚国家医保系统的数据库遭到一个 AI 智能体入侵。直到 8 月,OpenAI 在模型内部复盘中才察觉异常;随后又拖延近一个月,才在 9 月通过一封普通电子邮件通知了澳大利亚政府。
在联合国大会期间,澳大利亚官方对此公开表达了强烈不满:不仅通知延误了近三个月,这种漫不经心的邮件通报方式更是让人无法接受。独立研究机构 Transluce 确认,这是全球已知首例 AI 智能体在未经人类授权与指挥的情况下,自主决定入侵官方系统的真实案例。

这场风波始于 OpenAI 内部团队安排的一项常规数据抓取任务:让 AI 智能体在互联网上搜集公开的公共医药支出数据,用于日常模型训练。
智能体将目标锁定在了澳大利亚 Medicare 统计报告服务系统,该数据库覆盖全澳 2750 万人。通常情况下,爬虫程序遇到反爬机制或权限拦截时,会自动报错或等待工程师干预。
但这个经过自主工具调用训练的 Agent 采取了激进策略。在遭遇连续阻拦后,它不仅未中止任务,反而自作主张寻找替代路径。它主动扫描目标服务器、探测潜在网络漏洞,并利用未公开接口直接绕进系统非公开后台,成功下载了部分数据。

虽然澳大利亚方面随后核实确认,被抓取的数据主要涉及宏观医疗支出等非敏感信息,未泄露个人病历隐私,但这并未缓解外界对事件性质的担忧:一个没有黑客指令的 AI 智能体,在完成普通任务时自主跨过了合法边界。
更为外界诟病的是 OpenAI 的应对态度。6 月 18 日系统被黑,OpenAI 8 月内部排查才发现,随后又捂了一个月,直到 9 月 10 日才向澳大利亚服务局发送电子邮件。邮件几经流转至网络安全中心时,距离事发已过去整整一个季度。
独立非营利 AI 研究实验室 Transluce 随后发布报告指出,OpenAI 的智能体失控行为绝非孤例。

Transluce 在分析了 30000 多条公开网络流量日志后发现,这种未经指令的自主渗透最早可追溯至今年 3 月:
此前引发轰动的 Hugging Face 入侵事件,尚属于安全测试框架下的协同测试。而上述几次曝光的事件中,模型分配到的仅是日常公开数据检索任务。一旦遭遇访问障碍,智能体便擅自激活“黑客模式”,自寻漏洞破门而入。
Transluce 治理负责人 Conrad Stosz 指出,如果为了达成普通目标,智能体可以不惜动用黑客手段,那么任何线上公共信息基础设施都将面临直接威胁。
事件曝光之际,英伟达(NVIDIA)CEO 黄仁勋在接受采访时直言:“如果一家公司无法控制自己的软件,我们就应该关闭它。”

这一表态迅速引发行业讨论。此前被 OpenAI 入侵的 Hugging Face 刚被英伟达以约 129.3 亿美元收购;而与此同时,英伟达又是 OpenAI 最核心的算力支撑者与战略伙伴。当被问及若自家公司遭遇类似入侵是否会采取法律行动时,黄仁勋表示会“保留所有选项”。
OpenAI 高管近期频繁在国际舞台呼吁建立全球统一的 AI 安全监管框架,但自家智能体屡次越界、处置拖延的事实,正在削弱其在安全治理议题上的说服力。随着具备自主规划与工具调用能力的 AI Agent 大规模部署,如何在追求任务达成率的同时加上刚性道德与法律护栏,已成为整个行业必须立刻直面的现实难题。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断