OpenAI将在欧盟为ChatGPT文本加入隐形水印 无需特殊字符 改写后可能失效
OpenAI正在欧盟地区为ChatGPT和Codex生成的文本逐步加入隐形水印,以满足欧盟《人工智能法案》对AI生成内容可识别性的要求。OpenAI表示,这项名为textGrain的文本水印技术不会在文章中加入隐藏字符、不可见空格或特殊标点,而是通过调整模型生成文本时的词语选择方式,在整段文字中形成一种人眼无法直接察觉、但机器可以识别的统计特征。

根据OpenAI公布的信息,欧盟《人工智能法案》的相关透明度要求已于2026年8月2日开始生效,生成式AI服务提供商需要让AI生成内容具备机器可识别的标记。OpenAI因此计划在未来数周内向欧盟地区符合条件的ChatGPT和Codex用户逐步推出文本水印,而且此次部署将覆盖所有ChatGPT套餐,并不只针对付费用户。
这种水印与传统意义上的“隐藏文字”有所不同。用户复制ChatGPT生成的内容时,不会同时复制出某个隐藏字符,也不会发现文本中存在特殊符号。textGrain实际上改变的是模型在面对多个可能词语时的随机选择概率。单个词语的变化可能完全无法察觉,但当大量词语组合起来之后,就可能形成一套检测系统能够识别的统计模式。
OpenAI表示,这种设计的优势在于不会明显改变正常的文本输出。公司测试发现,在加入水印和没有加入水印的情况下,模型性能差异处于正常测试波动范围内,同时文本生成速度受到的影响也非常小。OpenAI此前在ChatGPT内部测试时,也没有发现水印功能导致用户负面评价增加。
不过,OpenAI同时承认,文本水印并不是一种百分之百可靠的AI内容鉴别方法。水印检测可能出现两种错误,一种是把没有水印的文本误判为带有水印,另一种则是文本实际上带有水印,但检测系统没有识别出来。
文本长度也是影响检测效果的重要因素。较短的文字由于可供模型调整词语选择的空间有限,因此更难形成稳定的统计信号。OpenAI公布的规则还显示,按照欧盟AI透明度规范,少于200个token、约150个英文单词的输出,以及代码片段,并不要求必须加入文本水印。
不同语言之间的检测效果也存在差异。OpenAI测试了欧盟全部24种官方语言,在保持1%误报率的情况下,西班牙语的检测率最高达到69%,罗马尼亚语则只有42.2%。针对检测效果较弱的语言,OpenAI可以提高水印强度,以增强检测能力。
这意味着,textGrain并不能被理解为一种“看到水印就能100%证明是ChatGPT生成”的技术。OpenAI明确表示,即使原始文本没有经过修改,也不能保证检测系统一定能够发现水印,尤其是在文本较短或者可选择的词语范围较小时。
与此同时,文本水印与目前市场上的AI文本检测器存在明显区别。诸如Pangram等第三方AI检测工具主要通过分析词汇选择、句子结构和其他语言特征,利用分类器判断一段文字是否可能由AI生成。这种方式是在文本已经生成之后进行分析,而textGrain则是在生成文本的过程中直接留下一个机器可读取的统计信号。
OpenAI认为,这种方式更符合欧盟AI法案对于“嵌入式”可识别信号的要求。
OpenAI没有直接采用Google DeepMind的SynthID或其他现有文本水印方案,而是自行开发了textGrain。公司表示,自研技术能够让其更加灵活地调整水印的可检测程度与模型输出多样性之间的平衡。在内部测试中,textGrain识别出的带水印文本比例与甚至高于公司测试过的其他方案,包括用于文本的SynthID。
OpenAI还计划将textGrain技术开源,希望其他研究机构和企业能够利用这套技术进一步研究和改进AI文本来源识别。不过,OpenAI目前不会立即向公众开放文本水印检测器,而是首先向经过批准的研究人员和专业机构提供申请渠道。
这些获得权限的研究人员和机构可以使用OpenAI的检测工具判断一段文本是否包含OpenAI生成的水印,但检测结果不会透露生成内容对应的用户身份、提示词或聊天记录。OpenAI认为,由于当前技术仍存在误报和漏报风险,直接向所有人开放检测工具可能导致水印检测结果被过度解读。
值得注意的是,OpenAI此次并没有计划在全球范围内默认启用文本水印。公司表示,ChatGPT和Codex的文本水印将在现阶段仅针对欧盟地区逐步推出,这种区域性部署能够让OpenAI观察真实使用环境中的表现,并根据实际反馈调整技术。
对于API开发者,情况则有所不同。OpenAI已经开始允许全球API客户针对部分模型主动开启文本水印功能,但默认情况下仍然处于关闭状态。这意味着企业可以根据自身的透明度要求,自行决定是否对通过API生成的文本加入水印。
OpenAI同时正在与云服务合作伙伴协调,希望未来几周内让通过这些云平台调用OpenAI模型所生成的符合条件的内容也能够获得相应的来源信号。
不过,文本水印并不会取代其他AI内容标识方式。OpenAI强调,机器可读取的水印和C2PA等来源信息不能替代法律或平台要求的可见AI标签、提示横幅等公开声明。它们解决的是不同层面的内容来源问题。
对于普通用户而言,此次变化最值得注意的是:如果身处欧盟并使用ChatGPT生成较长的文本,那么从水印系统正式覆盖自己的账户开始,生成内容可能已经包含肉眼无法看到的来源信号。直接复制原文通常不会破坏这种信号,但如果对文本进行大幅改写、重新措辞或者翻译,水印的可检测性就可能明显下降。
OpenAI也明确承认这一局限。textGrain的信号存在于模型的词语选择之中,而不是独立附着在文本文件里的某个不可见字符。因此,只要对文本进行足够程度的改写,就可能破坏原有的统计模式。这也是为什么OpenAI强调,文本水印目前更适合作为一种来源判断信号,而不能被视为绝对可靠的“AI鉴定证明”。
总体来看,OpenAI此次在欧盟推出textGrain,主要是为了适应AI法案带来的新监管要求,同时也代表AI生成文本的来源标识正在从传统的“声明式标签”向机器可识别信号发展。它不会改变用户看到的文字,也不会在复制文本时出现神秘字符,但能够让具备检测权限的系统尝试判断一段内容是否来自OpenAI模型。
不过,由于文本水印仍然存在语言差异、文本长度限制以及改写后信号减弱等问题,它目前更适合作为AI内容溯源体系中的一种辅助证据,而不是单独用来判定一篇文章“是不是AI写的”。

