为遵从《欧盟人工智能法案》,OpenAI 推出隐式文本水印技术 textGrain。该方案将在欧盟区 ChatGPT 中灰度上线,并向全球 API 开放选配,旨在推进 AI 文本溯源并兼顾当前技术局限。
为遵守《欧盟人工智能法案》(EU AI Act)关于生成式 AI 文本需具备机器可读标识的监管要求,OpenAI 正式公布了其文本水印技术方案及落地路线图。
内容可追溯性有助于识别内容的来源与生成方式。OpenAI 此前已开放针对图像和音频的鉴别工具,此次则将溯源能力延伸至文本领域。
鉴于文本水印技术仍处于早期阶段且存在局限性,OpenAI 采取了分步推进的策略:
需要指出的是,面向图像和音频的验证工具(包括 openai.com/verify 网页工具与内容溯源 API)仍将保持公开可用。
OpenAI 采用的文本水印技术名为 textGrain。该技术会在模型选词时嵌入微弱的不可见统计信号,配套检测器则通过捕捉该信号判断文本是否由 OpenAI 模型生成。OpenAI 已发布相关技术报告,并计划未来对该技术进行开源。
评估显示,textGrain 的表现达到或优于谷歌 DeepMind 的文本版 SynthID。但在实际应用场景中,水印检测依然面临技术挑战:
OpenAI 在前沿模型 Astra 上评估了水印对生成质量的影响,各项基准测试表明,嵌入水印对模型能力几乎没有负面影响:
| 测试基准 | 无水印文本 (Astra, max) | 嵌入水印文本 (Astra, max) |
|---|---|---|
| Artificial Analysis Intelligence Index | 49.57 分 | 49.76 分 |
| AutomationBench | 34.09% | 34.86% |
| DeepSWE v1.1 | 72.80% | 71.68% |
| Terminal-Bench 4.0 | 53.90% | 56.06% |
| Terminal-Bench Science 0.1 | 56.90% | 60.00% |
| BrowseComp | 87.92% | 87.35% |
| HealthBench Professional | 64.27% | 64.60% |
| GPQA Diamond | 94.44% | 93.94% |
OpenAI 强调,文本水印能够提供的信息十分有限,外界需客观理解其检测结果:
单一技术难以应对所有溯源需求。OpenAI 正在推进多层防御策略:支持 C2PA 认证并添加 Content Credentials 元数据,同时在图像与音频中嵌入不可见的 SynthID 水印。
正如在选举保障工作以及此前披露的规划中所述,OpenAI 将遵循欧盟相关实践准则,持续研究水印在翻译、改写环境下的抗干扰能力,并参考帮助中心说明收集的反馈,在确保负责任使用的前提下逐步扩大检测工具的开放范围。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断