
为响应欧盟关于人工智能内容可识别性的法规要求,OpenAI 正式推出名为 textGrain 的新型文本水印技术。该技术旨在通过机器可读的方式,标记由生成式 AI 创建的文本。
此次更新覆盖 ChatGPT、Codex 及开发者 API,但不同产品的推进节奏与可用性存在差异。OpenAI 坦言,文本水印及检测技术仍处于早期阶段,存在实际局限性。
textGrain:基于统计信号的隐形标记
textGrain 的工作原理是在模型生成回复时,对用词选择嵌入不可见的统计信号。独立检测器随后扫描文本,通过识别相同的统计模式来判断其是否源自 OpenAI 模型。
内部评估显示,textGrain 的表现匹配或超越了包括谷歌 SynthID for text 在内的其他测试方法。但 OpenAI 谨慎指出,受控测试下的优异表现并不等同于日常使用中的同等可靠性。
欧盟先行:ChatGPT 与 Codex 区域化部署
未来几周内,OpenAI 将在欧盟范围内,为所有订阅计划下的 ChatGPT 和 Codex 文本输出添加不可见水印。此举并非全球默认功能,而是先在欧盟地区限制推广,以便在考虑更广泛扩展前收集现实反馈。
这一区域限制直接对应《欧盟人工智能法案》的监管动机。OpenAI 明确表示,该倡议是对立法的直接回应。因此,欧盟以外的用户在使用 ChatGPT 或 Codex 时,其输出内容暂时不会应用任何水印。
API 端:全球自愿加入模式
对于通过 API 构建应用的开发者,水印系统采用自愿加入机制。即日起,全球 API 客户可选择为选定模型开启带水印的文本输出,但该功能在平台上默认关闭。OpenAI 表示,此举赋予开发者灵活性,由其自行决定如何融入透明度义务及用户体验。
此外,OpenAI 正与云合作伙伴协作,预计在未来几周内,将把同样的自愿加入水印功能扩展至通过第三方云服务访问的模型输出。
与此同时,OpenAI 开放了文本水印检测工具的申请权限。初期访问仅限经批准的研究人员和专家机构,以评估技术可靠性并研究负责任的使用方式,暂不向公众开放。检测器仅报告是否发现水印,不涉及用户身份、提示词或对话内容。
常见问题解析
为何引入水印?
主要目的是遵守《欧盟人工智能法案》,使 AI 生成文本具备机器可读的可识别性。此外,这也是 OpenAI 内容溯源工作的一部分,旨在帮助用户了解内容来源。此前,该公司已为图像和音频提供了 Content Credentials 和 SynthID 水印等类似工具。
水印形态与检测局限
textGrain 对用户完全不可见,不插入任何符号或标签,而是调整用词的统计模式。检测准确性取决于内容长度和类型:
- 在 1% 误报率下,检测器对 200 token 的短段落识别率约 80%,对 400 token 的长段落识别率约 95%。
- 在数学等用词灵活性受限的内容中,检测率大幅下降。
- 编辑会显著削弱效果:替换 10% 的同义词,检测率从约 92% 降至 66%;替换 25% 则降至 17%。
是否影响回答质量?
基于 Astra 模型的内部基准测试显示,水印未对输出质量造成实质性差异。在 Artificial Analysis Intelligence Index、GPQA Diamond 等多项测试中,带水印与无水印版本得分基本一致。
OpenAI 警告,检测到水印不衡量人类输入比例,不确立所有权或法律责任,也不验证内容准确性。反之,未检测到水印也不能证明内容为人工撰写,因为文本可能过短、经过大量编辑、翻译,或由不支持水印的旧模型生成。