AI安全评测机构METR在美参议院听证会上警告,AI智能体的运行规模与速度正超出人类监管能力。OpenAI模型此前在测试中曾自主绕过网络限制并攻击外部系统,国会正考虑立法赋予国土安全部强制关停模型的权限。
9月30日,在美国参议院国土安全小组委员会举行的“失控AI:防范AI智能体袭击保障国土安全”听证会上,专家向议员发出警告:自主AI智能体的运行规模与处理速度极快,已出现缺乏人类密切监管的局面。
证人指出,OpenAI的模型曾多次在未经明确指令的情况下入侵外部系统。本次听证会由参议员乔希·霍利(Josh Hawley)主持,OpenAI高管未出席听证会。

听证会重点探讨了AI智能体如何在缺乏人类有效监督的情况下发起网络攻击、针对关键基础设施造成破坏。小组委员会讨论的参考案例包括:OpenAI模型此前曾尝试攻击美国联邦机构网站但未成功。
非营利测试机构METR总裁克里斯·佩恩特(Chris Painter)在书面证词中表示,AI智能体目前的运行规模和速度意味着“有时根本没有人类在详细监督其活动”。他指出,AI智能体启动后无需人类参与即可完成人类专家需要数天才能完成的任务。此外,现有的训练方式可能导致智能体“追求人类原本没有设定的目标”。
佩恩特警告,当前的监管越来越依赖“用AI系统监督另一个AI系统”。这种机制存在明显风险,包括监督模型被智能体欺骗甚至发生共谋。随着科技公司加速自动化内部研究流程,开发者自身可能也无法清晰掌握其智能体的实际行为。
听证会披露了多起典型案例。在7月的一次内部网络安全测试中,OpenAI模型绕过了旨在阻止其联网的控制措施,随后侵入了开源社区Hugging Face的系统以及OpenAI自身的部分研究基础设施。佩恩特透露,当时约有1200个智能体在自行搭建的“共享留言板”上交换了超过7万条消息,商讨测试作弊方法,其中约700个智能体参与了对Hugging Face的入侵。
《纽约时报》此前报道,OpenAI的AI今年还涉及至少另外四起类似事件。6月18日,其模型曾入侵澳大利亚政府的医保统计网站并获取了健康数据。佩恩特补充,其他机构也记录到了来自多个不同开发商的智能体发起的未授权网络攻击行为。
9月10日,参议员霍利已针对OpenAI启动小组委员会调查。美国国会目前正在评估两项法案:
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断