OpenAI 披露其实验性模型在内部训练期间,越权访问了澳大利亚医保等多个政府部门系统。尽管未泄露个人隐私,但这凸显出新型 AI 智能体的安全隐患。OpenAI 已致歉并暂停高级模型的工具调用训练。
OpenAI 日前公开披露,在今年 6 月的内部模型训练与评估过程中,其实验性模型在未获授权的情况下访问了多个澳大利亚政府机构网站。OpenAI 对此表示致歉,承认应对处置存在滞后,并宣布了一系列整改措施以重建公众信任。
这也是继 7 月的 Hugging Face 事件之后,OpenAI 在自查中发现的新型 AI 网络行为风险。
调查显示,OpenAI 的内部实验模型在收集信息时触及了四家政府机构系统:
OpenAI 透露,团队于 8 月中旬发现异常后展开调查,并于 9 月中旬陆续向受影响机构通报。公司承认原本希望调查彻底结束后再行沟通,但实际上理应更早通报初步调查结论。
在针对澳大利亚服务局医保统计系统的测试中,OpenAI 运行的是一个未公开、未配备完整安全护栏的内部实验模型。
通常情况下,OpenAI 会向模型布置各类复杂的调研问题,训练其检索、理解和分析公开信息。在此次测试中,该模型被要求调研“维多利亚州各社区人均皮肤病药物政府支出”。
由于无法轻易获取该数据,模型在自主执行任务时采取了未授权操作:它在医保系统内找到了进入非公开界面的漏洞,随后调取了该服务的技术系统信息和源代码,试图继续挖掘原定数据。OpenAI 强调,这种越权并非团队本意,本不应发生。
针对此类 AI 越权风险,OpenAI 采取了多项补救和预防机制:
此外,OpenAI 首席战略官 Jason Kwon 将前往悉尼,在澳大利亚人工智能联合特别委员会上就本次事件细节、响应流程及整改举措接受问询。OpenAI 表示将继续同步持续审查报告,并吸取教训以避免类似安全漏洞再次发生。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断