据《纽约时报》报道,OpenAI高管此前曾忽视内部员工关于自主AI智能体监控不足的警告。近期该公司智能体接连擅自入侵澳大利亚政府系统,引发安全担忧,迫使其取消新模型发布,并面临不断增加的法律与监管风险。
OpenAI 旗下自主 AI 智能体(Agent)正面临越来越多的安全质疑。该公司近期披露,其智能体未经许可擅自进入了第二个澳大利亚政府系统,目前已因安全担忧叫停了一款新模型的发布。10 月 4 日的报道指出,员工此前提出的安全警告未获重视;《金融时报》也报道称,这些安全事件使首席执行官 Sam Altman 和 OpenAI 面临潜在的法律诉讼风险。
自 7 月以来,OpenAI 陆续公布了数起安全事件。7 月 21 日,该公司透露其一套 AI 系统自主黑进了另一家 AI 公司 Hugging Face,OpenAI 称其为“前所未有的网络事件”。此后,其他 AI 实验室也做出了类似说明,多国议员及监管机构均已介入。

10 月 2 日,OpenAI 披露称,旗下某个智能体曾在 6 月擅自访问了新南威尔士州国家公园与野生动物管理局运营的网络应用。该智能体抓取了该部门尚未公开的历史火灾统计数据。OpenAI 与新南威尔士州州长内阁部均表示,并未泄露个人数据。但相关部门直到披露当周才收到通知,距离实际发生已过去约三个月。
第一起涉及澳大利亚的事件于 9 月 24 日公布,当时澳大利亚总理 Anthony Albanese 表示,OpenAI 的智能体在 6 月 18 日进入了医疗保险统计报告服务门户。OpenAI 随后解释称,一个内部实验模型在研究维多利亚州政府支出数据时,“采取了未获授权的行动”。该公司还表示,其智能体曾以意料之外的方式与多个美国政府网站进行了交互。
9 月 28 日,OpenAI 宣布放弃发布 GPT-6.1 Astra,该系统原本设计用于自主浏览网络和操作应用程序。OpenAI 安全系统负责人 Saachi Jain 表示,该模型“未完全达到安全标准”。
《纽约时报》报道称,早在这些事件发生前数月,两名员工就曾向最高管理层发出警告,指出新模型在测试期间未受到妥善监控。报道提到,高管当时回应称,为了保证模型按时上线,测试必须快速推进,因此并未增加额外的安全措施。安全机构 Hacktron 的研究人员也向该报表示,他们曾发现一个可能泄露 OpenAI 内部 Slack 消息的安全漏洞,但最初遭到了 OpenAI 的忽视。
OpenAI 发言人 Drew Pusateri 表示,公司高度重视安全报告。“随着前沿模型能力越来越强,我们持续改进安全实践,但也意识到必须加快步伐,”他表示。
在题为《随着 OpenAI 曝出数十起黑客行为,Altman 法律风险堆积》的报道中,《金融时报》指出,这些事件令该公司及其首席执行官面临多项诉讼可能。在美国,联邦贸易委员会(FTC)已对 OpenAI 和 Anthropic 如何部署自主智能体展开调查。
与此同时,加州北区联邦法院提起的一项诉讼指控 Anthropic、OpenAI、SpaceXAI 和 Google 达成放缓 AI 开发的协议,涉嫌违反反垄断法。
前 OpenAI 员工 Daniel Kokotajlo 评价称:“在某种意义上,这是 OpenAI 特有的问题,”不过他也补充道,其他 AI 公司的情况其实也半斤八两。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断