OpenAI 宣布对其前沿模型 API 客户提供零数据保留承诺,并预览隐私安全处理机制。该机制能在不向 OpenAI 人员暴露内容的情况下识别跨交互的滥用模式,以帮助企业满足日益严格的数据隐私与安全要求。
OpenAI 宣布,将向符合条件的 API 客户提供零数据保留(ZDR)承诺:请求处理完毕后,OpenAI 不会保留提示词或模型响应,其人员也无法访问客户内容进行审查1;除非企业客户明确选择加入,否则数据不会用于训练。
然而,随着模型承担更长期、更复杂的任务,一些严重风险可能只有通过多次交互才能显现,而现有 ZDR 安全系统只会单独评估每次交互。为此,OpenAI 预览了“隐私安全处理”机制,旨在识别相关交互中的行为模式,同时不让 OpenAI 人员接触内容。在 ZDR 部署中,客户内容仍保留在客户控制的基础设施上;OpenAI 还在开发另一种方案,将内容存储在 OpenAI 基础设施上,并使用客户控制的密钥进行加密。两种情况下,自动化系统都能识别潜在滥用并返回有限安全信号,而不会向 OpenAI 人员暴露相关提示词或响应。
OpenAI 解释,最严重的 AI 安全风险不一定在单次交互中显现,恶意行为者可能反复试探保障措施、跨账户协同行动,或将威胁伪装成常规研究;智能体任务执行期间风险也可能逐渐形成,例如系统在被要求停止后仍继续行动。近期一些前沿模型部署要求客户允许提供商保留敏感内容用于安全监测,这与许多组织的安全义务相冲突,而隐私安全处理旨在继续提供 ZDR 的同时解决这一问题。
隐私安全处理基于现有 ZDR 自动化保护机制,将分析范围从单次交互扩展到相关交互。无论客户内容存储在客户控制的基础设施还是 OpenAI 提供的加密存储中,OpenAI 人员都没有密钥副本,无法访问内容。一旦发现风险,OpenAI 只会收到严格限定的信号,指示活动类型,用于判断是否需要处置;即使客户内容被标记,OpenAI 人员也无权访问。客户可使用自身系统中的信息调查警报和处置决定,并可在申诉或协助调查时选择与 OpenAI 分享相关信息。
OpenAI 表示,隐私安全处理目前正与早期客户测试,计划于 9 月开始推出并发布技术白皮书。OpenAI 强调,没有任何一家 AI 实验室能够独自应对新出现的风险,我们的原则也指出这一点,因此该机制由不同行业、地区和企业规模的客户共同参与完善。Glean 首席信息安全官 Sunil Agrawal 评价称,OpenAI 对数据不用于训练的承诺和 ZDR 让 Glean 能够放心使用 OpenAI,且 OpenAI 证明了安全水平可以持续提升,同时不牺牲维系企业信任所必需的隐私与控制权。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断