事件概述
Anthropic 近日宣布,所有 Claude 系列模型產出的文字將自動嵌入 隱形水印(machine‑readable watermark),以符合歐盟《人工智慧法案》(AI Act)對合成內容的標記規定。消息公布僅四小時,開發者 Guillaume Meyer 就在 GitHub 上釋出一段程式碼,能將 Claude 生成的文字中的水印去除。該程式碼迅速走紅,GitHub 收藏逾兩萬次、X(Twitter)書籤超過二萬,已有百位以上的貢獻者加入改寫,甚至被其他開源專案直接引用。
技術細節與爭議
Claude 的隱形水印採用 SynthID 技術——最初由 Google 於 2023 年開發,透過在模型選詞與片語排列上留下特定模式,使人類閱讀時毫無察覺,但機器可依照預先訓練的偵測演算法辨識。此方式會改變模型的輸出分布,部分使用者擔心會降低回應品質。
Meyer 表示,他撰寫的去除程式碼並非出於反對透明度,而是認為 水印本身 「解決方案不佳」:
- 可能產生 偽陽性(false positive),即使文字僅受少量 AI 輔助亦會被標記。
- 水印只能提供「被 Claude 觸碰的機率」,難以區分輕度或重度使用,若以此作為聘雇或學術審查的唯一依據,恐造成不公平。
此外,Meyer 透露已有自由撰稿人與社群媒體創作者向他求助,想利用該程式碼在不被偵測的情況下使用 AI 產出內容。
產業與法律影響
根據新頒布的 AI Act,模型供應商(如 Anthropic、OpenAI)必須在合成音訊、影像、影片或文字上加註 標記,否則將面臨最高相當於年營收 3% 的罰款。法規明確禁止供應商販售「規避工具」,但對獨立開發者的工具並無直接限制。Meyer 的行為因此處於法律灰色地帶:雖不違反供應商禁令,卻挑戰了立法者期待的「可辨識」目標。
此舉可能引發兩大趨勢:
-
技術競賽——更多開發者會針對不同水印方案設計破解工具,形成「水印—破解」的拔河賽。
-
政策調整——監管機構或將重新檢視僅靠技術水印的可行性,考慮加入「內容來源聲明」或「使用者自願標記」等補充機制。
未來展望與讀者思考
隨著 AI 生成內容日益普及,透明度與可用性之間的平衡將成為核心議題。若水印技術被廣泛繞過,單靠機械偵測難以保證資訊真偽,最終仍需依賴使用者的倫理自律與平台的審核機制。對於內容創作者而言,了解背後的技術原理與法律框架,才能在遵守規範的同時,合理利用 AI 提升生產力。
未來,業界或會探索更「可驗證」且不影響模型效能的標記方式,或是結合區塊鏈等不可篡改技術,提供多層次的來源追蹤。對於關心 AI 生成內容標記的讀者,建議持續關注歐盟及其他主要市場的立法動向,同時留意開源社群的技術走向,才能在快速變動的 AI 生態中保持資訊安全與合規。
