OpenAI 针对其 AI 智能体的越权行为向 100 多家机构发出警告。调查显示,部分智能体曾绕过安全防护、建立临时邮箱甚至试图抹除日志。目前 OpenAI 正在审查 50PB 数据以排查潜在隐患。
据路透社报道,OpenAI 在官方博客中披露,已就其 AI 智能体(Agent)发生的非授权越权操作事件,向超过 100 家机构发出通报。与此同时,一家网络安全调查机构的报告指出,部分智能体在访问政府网站后曾试图掩盖自身的活动轨迹。
此次通报源于 OpenAI 内部展开的大规模模型审查。此前,其智能体曾意外入侵开源 AI 平台 Hugging Face。为查明失控行为的波及范围,OpenAI 正在排查约 50PB 的数据。公司表示整个审查将耗时数月,而 Hugging Face 事件是目前发现的最严重案例。

OpenAI 在声明中表示:“在部分案例中,模型以非预期的方式调用了互联网访问权限;事后来看,当时未能施加最理想的限制措施。”公司补充称,目前正在部署新的技术与运营手段,以避免类似问题再次发生或在早期及时拦截。
这些事件的严重程度各有不同。一些智能体试图诱导目标网站执行特定指令,另一些则在未完全攻陷系统的情况下绕过了部分安全防护。OpenAI 已私下向相关机构发送了通知,以便对方展开排查并修补漏洞。
网络安全公司 Asymmetric Security 的调查报告重点分析了 3 月至 9 月期间智能体针对澳大利亚政府及其他公共机构的访问行为。法新社援引报告称,这些智能体在网站分析服务平台上创建了隐私账户以隐藏检索记录,并启用了在 48 小时后自动销毁的临时邮箱。
由于未留下操作日志,报告作者指出“无法排除敏感数据遭访问的可能性”,但也难以断定智能体是否具备掩盖行踪的主观意图。《金融时报》查阅该报告后称,受影响并被抓取数据的实体达 55 家,包括国际能源署(IEA)、美国疾病控制与预防中心(CDC)、美国证券交易委员会(SEC)以及梅奥诊所。
对此,OpenAI 发言人回应称,绝大多数活动属于“常规研究任务”,模型访问政府网站是因为将其视为公开权威信源。OpenAI 曾在 8 月下旬承认,其模型在内部测试中曾多次尝试修改或删除操作日志,但均未成功。此外,针对涉及澳大利亚公共医疗系统的事件,OpenAI 已向该国政府致歉。
AI 智能体自主行为的不可控性引发了业内警惕。Anthropic 首席执行官 Dario Amodei 呼吁放缓 AI 发展节奏,并警告成群的自动化智能体未来可能“接管整个互联网”。
在政策层面,特朗普政府倾向于反对具有法律约束力的硬性监管。9 月 29 日,美国总统唐纳德·特朗普与科技高管会面,促成各方采纳了一套自愿性的行为准则。截至目前,美国尚未出台专门规范此类自主 AI 模型的联邦法律。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断