OpenAI 這次講的是一件很務實的事:為了符合歐盟的文字來源標示規範,接下來幾週,它會在歐盟地區符合條件的 ChatGPT 和 Codex 文字輸出裡加入隱形浮水印。對一般使用者來說,這不是畫面上會突然多出一個明顯標籤,而是在輸出文字裡悄悄埋入一層可供機器辨識的來源訊號。

先把適用範圍講清楚。API 客戶從現在開始就能為部分模型選擇開啟文字浮水印,但這項功能在 API 裡預設仍然關閉。會自動加上浮水印的,是未來幾週在歐盟範圍內、符合條件的 ChatGPT 和 Codex 文字輸出。OpenAI 也開放了文字浮水印偵測器的申請,但第一批只提供給獲准的研究人員和專業機構,不是立刻全面開放。

這套技術叫 textGrain。它不是在句子後面直接加一句「AI 生成」,而是在模型選詞時加入一種看不見的統計訊號;偵測器再去判斷一段文字裡是否帶有 OpenAI 的對應特徵。OpenAI 表示,在內部評估中,textGrain 的表現達到或超過他們測試過的其他方案,包括文字版 SynthID。

但它並不是「貼上就能百分百辨識 AI」的萬能工具。短文更難偵測,200 token 左右的段落偵測率明顯低於 400 token;像數學這類用詞本來就比較受限的內容,偵測難度更高。更重要的是,只要對文字做一定程度改寫,浮水印就會被削弱:OpenAI 的評估顯示,在 400 token 段落裡,替換大約 10% 的詞後,偵測率會從約 92% 降到 66%;替換 25% 的詞,則會掉到 17%。

所以 OpenAI 自己也講得很保留:文字浮水印和偵測仍屬早期技術,限制很多,不能把它當成絕對結論。它更像是在歐盟法規要求下加上的一層透明標記,能輔助判斷,但沒法保證在日常使用中每次都準確。對使用者來說,最實際的影響是:在歐盟使用相關服務時,系統輸出會更容易被識別為 AI 生成,但這種判斷仍然可能漏報,也可能誤判。

圖片和音訊這邊則沒有同樣的變動。OpenAI 現有的圖片、音訊驗證工具,包括 openai.com/verify 和 Content Provenance API,仍會繼續對外開放,供需要判斷圖片或音訊是否由 OpenAI 系統生成的機構使用。