核心消息
OpenAI 宣布將在 ChatGPT 產出的文字中加入隱形水印(稱為 textGrain),以符合 歐盟 AI 法規 的機器可讀標記要求。與 Anthropic 的 Claude 採取全域強制水印不同,OpenAI 的 API 水印採 全球自選(opt‑in)模式,並將於未來數週在歐盟區域的 ChatGPT 與 Codex 用戶預設開啟,同時透過 Microsoft Azure 等雲端合作夥伴提供。
技術原理與測試結果
textGrain 透過在模型選字時植入統計訊號,形成肉眼不可見、但可機器偵測的水印,類似 Anthropic 以 Google 開源技術實作的 SynthID。OpenAI 內部測試顯示,該技術在偵測率上不遜於或優於其他方案,包括 Google 的 SynthID。
- 偵測率與文字長度:在偽陽性率設定為 1% 時,對 400 token(約 250 字)之心理學段落偵測成功率約 95%;縮短至 200 token 時下降至約 80%。
- 內容類型差異:數學內容因詞彙選擇受限,偵測率顯著較低。
- 編輯抗性:僅替換 10% 的詞彙為同義詞,偵測率即從約 92% 降至 66%;若替換 25% 則跌至 17%,說明水印相當容易被刻意抹除。
OpenAI 亦指出,加入水印不會影響模型輸出品質。以其前沿模型 Astra 為例,於八項基準測試(含 GPQA Diamond、BrowseComp、DeepSWE)中,開啟與關閉水印的成績差異不具統計顯著性。
法規與產業影響
根據《歐盟 AI 法規》草案,AI 服務提供者必須以機器可讀格式標示生成內容。OpenAI 的做法符合此要求,同時保留 API 使用者自行決定是否啟用的彈性,較 Anthropic 的全域強制政策更具市場適應性。若水印易被刪除,部分使用者可能轉向 開放權重模型(open‑weight models)以規避偵測,這將對 OpenAI 的商業模式產生微妙影響。
未來展望
OpenAI 計畫將 textGrain 開源,讓業界能在此基礎上進一步優化偵測演算法或開發新型防篡改機制。雖然水印本身不揭示創作的人類貢獻度、所有權或真實性,但其存在與否將成為辨識 AI 生成內容的重要線索。未來,隨著歐盟法規逐步落實,更多 AI 供應商可能必須採取類似技術,業界也將持續探討如何在透明度與可用性之間取得平衡。
讀者提示:若您關注生成式 AI 的合規風險,建議留意服務供應商的水印設定,並在重要文件或公開發表前,使用可靠的偵測工具驗證內容來源。
