OpenAI 预览隐私安全处理,在零数据保留承诺下跨交互识别风险,客户内容对 OpenAI 人员不可见。该功能旨在平衡前沿模型安全监控与企业数据隐私需求,预计 9 月推出。
OpenAI 预览了隐私安全处理(Private Safety Processing),旨在让客户在享受零数据保留(ZDR)承诺的同时获得更全面的安全保护。此前,OpenAI 承诺不保留 API 客户的提示词和模型输出,客户内容不向 OpenAI 人员开放审查1,企业数据默认不用于训练,除非客户明确选择参与。
随着 AI 模型承担更长、更复杂的任务,一些严重风险可能只有在多次交互中才会显现,而现有 ZDR 兼容的安全系统只能逐次评估交互。隐私安全处理正是要填补这一空白:它在相关交互之间建立联系,让自动化系统识别滥用模式,同时不向 OpenAI 人员暴露底层内容。
在 ZDR 部署中,客户内容保留在客户控制的基础设施上。OpenAI 同时也在开发另一种选项,将内容存储在 OpenAI 提供的基础设施上,并使用客户控制的密钥加密。OpenAI 人员不持有密钥副本,因此无法访问内容。无论内容存储在哪里,当自动化系统发现风险时,OpenAI 只会收到一个类型明确的安全信号,用于判断是否需要采取强制措施;即使内容被标记,OpenAI 人员也不会获得访问权。客户可自行调查警报与处置决定,若需申诉、澄清合法使用或配合调查,可选择主动将相关信息分享给 OpenAI。
OpenAI 强调,最严重的 AI 安全风险很难在单次交互中看清。攻击者可能反复探测防护、跨账户协调,或将恶意意图伪装成常规研究;在智能体任务中,系统也可能偏离用户意图,例如在收到停止指令后继续行动。因此,跨交互的上下文对于区分正常使用与滥用、确保智能体不超出授权范围至关重要。
此前,一些前沿模型部署要求客户允许 AI 提供商保留敏感内容用于安全监控,这与许多企业的安全义务相冲突。OpenAI 表示,隐私安全处理的目标是在不放弃 ZDR 的前提下继续提供安全保护。目前该功能正与早期客户测试,OpenAI 计划在 9 月启动推出并发布技术白皮书。正如 OpenAI 在其原则中所述,没有哪家 AI 实验室能独自应对新兴风险;来自不同行业、地区和规模的企业正在参与设计这些防护机制。
Glean 首席信息安全官 Sunil Agrawal 表示:“企业采用 AI 完全取决于客户对数据的控制,除所选服务外不得有直接或衍生使用。OpenAI 的不训练承诺和 ZDR 让我们有信心在其平台上构建。随着模型能力增强,OpenAI 证明了安全可以进步,而无需牺牲维持企业信任所需的隐私与控制。”
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断