OpenAI 推出 TextGrain 隱形文字浮水印,符合歐盟 AI Act
OpenAI 於 10 月 5 日正式公布 TextGrain,這項在生成文字時植入肉眼無法察覺、但系統可驗證的統計訊號的技術,將在未來幾週內於歐盟區域的 ChatGPT 與 Codex 輸出中啟用,直接回應《人工智慧法》(AI Act)第 50 條第 2 款要求 AI 供應商必須讓生成內容帶有機器可讀標記的規範。
背景與法規需求
自 2023 年 8 月 2 日《AI Act》生效以來,歐盟要求所有文字、圖片、音訊或影片的 AI 生成內容必須具備可辨識的標記。OpenAI 早前已在圖像與音訊加入 C2PA(內容來源驗證標準)與 SynthID(聲音指紋)等機制,然而文字因為常被改寫、刪減或翻譯,標記容易被破壞,長期以來實作難度較高。
TextGrain 的技術原理
OpenAI 在技術報告中說明,TextGrain 並非在文字裡直接嵌入固定字串,而是在模型選字的過程中加入極細微的偏差。這些偏差累積形成一種統計模式,肉眼看不出任何異常。使用對應的祕密金鑰即可檢測出是否帶有 OpenAI 的浮水印。此方式兼顧 偵測率 與 生成品質,在不影響語意與流暢度的前提下,提供可驗證的標記。
現行偵測工具的差異與限制
市面上已有多種 AI 文字偵測工具,主要依賴用詞、句型或可預測性等特徵來推測內容來源,屬於「後驗」式判斷。TextGrain 則是「前置」式的標記,直接在生成階段植入可驗證訊號,原理截然不同。儘管如此,OpenAI 仍指出以下限制:
- 文字長度:短句或像數學、程式碼等用詞受限的內容,偵測準確度顯著下降。
- 誤判率:在將誤判率控制在 1% 時,約 200 個 token(約 150 字)的心理學段落偵測率為 80%,提升至 400 個 token 可達 95%。
- 改寫衝擊:若將 400 token 文章的 10% 詞彙換成同義詞,偵測率會從約 92% 降至 66%;換 25% 後則僅剩 17%。
因偵測仍可能出現漏判與誤判,OpenAI 暫不公開 TextGrain 偵測器,而是先開放給研究人員與專業機構申請使用。
影響與未來展望
TextGrain 為文字類 AI 內容提供了可驗證的機制,對於符合歐盟 AI Act、提升產業透明度具有重要意義。未來若能結合更強韌的改寫防護或與其他驗證標準(如 C2PA)整合,或許能降低改寫後訊號的衰減。對於內容創作者、平台與監管機構而言,理解 浮水印 的局限與正確解讀偵測結果,同樣是避免誤用與濫用的關鍵。
讀者提示:偵測到 OpenAI 浮水印僅能說明該文字可能曾由 OpenAI 系統處理,並不等同於判斷人類參與程度或內容真偽;未偵測到則不代表一定為人工撰寫。未來隨著技術成熟,透明且負責任的 AI 生成生態有望逐步成形。
