随着人工智能生成内容的普及,AI文本的识别与审查成为行业焦点。据知情人士透露,OpenAI计划通过引入不可见水印技术,改变ChatGPT和Codex生成文本难以溯源的现状。
受《欧盟人工智能法案》要求AI生成内容需具备机器可读标识的影响,OpenAI的水印程序将率先在欧盟落地。在未来几周内,符合条件的ChatGPT和Codex文本输出将在欧盟范围内自动添加不可见水印。此外,全球API用户也可选择针对特定模型启用该功能。
技术原理与局限性
OpenAI将该水印技术命名为“textGrain”。其原理是在模型词汇选择中嵌入统计信号,检测器通过识别该信号来验证文本来源。尽管OpenAI声称textGrain的性能优于现有测试方法,但该技术并非完美无缺。
官方指出,检测器可能出现两类错误:误报不存在的水印(假阳性)或遗漏存在的水印(假阴性)。较短的文本片段更难被检测,而对文本的编辑操作也可能削弱水印效果。此外,该系统无法判定人类在文本中的贡献比例、内容所有权、创作者身份,也无法验证信息的准确性。
目前,OpenAI正接受文本水印检测器的访问申请,初期权限仅授予经批准的研究人员和专家机构,以协助技术测试。公司表示,采取区域性先行策略旨在从现实世界反馈中学习,该系统暂时不会在全球范围内全面推广。