OpenAI 这次说的是一件挺实际的事:为了响应欧盟的文本来源规则,接下来几周,它会给欧盟地区符合条件的 ChatGPT 和 Codex 文字输出加上隐形水印。对普通用户来说,这不是页面上会弹出的新按钮,更像是输出内容里悄悄埋了一层“来源标记”,方便后续做机器识别。

先理清范围。API 客户从现在开始就可以选择为部分模型开启文本水印,但这项功能在 API 里默认还是关的。真正会自动加上水印的,是未来几周欧盟范围内 eligible 的 ChatGPT 和 Codex 文本输出。OpenAI 还开放了文本水印检测器的申请通道,但首批只给获批的研究人员和专业机构,不是马上对所有人开放。

这项水印技术叫 textGrain。它不是在句子末尾加一句“AI 生成”,而是在模型选词时加入一种看不见的统计信号;检测器再去读这段文字里有没有对应的特征,判断它是否带有 OpenAI 的水印。OpenAI 说,textGrain 在内部评估里的表现达到或超过他们测试过的其他方案,包括文本版 SynthID。

但它远不是“一眼辨真假”的万能工具。短文本更难检,200 token 左右的段落检出率明显低于 400 token;像数学这种用词选择本来就很受限的内容,检测难度更高。更关键的是,只要对文本做一定改写,水印就会被削弱:OpenAI 的评估里,400 token 段落如果换掉约 10% 的词,检出率就从大约 92% 降到 66%;换掉 25%,会掉到 17%。

所以 OpenAI 自己也把话说得很克制:文本水印和检测还是早期技术,限制很多,不能把它当成绝对结论。它更像是欧盟合规要求下的一层透明信号,能辅助判断,但没法保证在日常使用里次次准确。对使用者来说,最重要的一点是:以后在欧盟用相关服务时,系统输出会更容易被识别为 AI 生成,但这种识别依旧可能漏报,也可能误报。

图片和音频这边没有变。OpenAI 现有的图片、音频验证工具,包括 openai.com/verify 和 Content Provenance API,仍然继续对外开放,给想判断图片或音频是不是由 OpenAI 系统生成的机构使用。