Anthropic 導入隱藏浮水印標記 AI 生成內容
Anthropic 公布了其 AI 模型 Claude 的內容標記規畫,自 8 月 2 日起在歐盟推出的新 Claude 模型將支援機器可讀標記。這項標記機制將套用至全球服務,為 AI 生成內容的透明度提供了一個新的解決方案。
背景分析
Anthropic 的這一舉動是對歐盟《人工智慧法》(AI Act)第 50 條相關的 AI 生成內容透明度實務準則的回應。該法規要求生成文字、圖片、音訊及影片等內容的 AI 系統,以機器可讀方式標記 AI 生成或修改的內容。這項規定已自 8 月 2 日起適用,旨在提高 AI 生成內容的透明度和可靠性。
標記機制
Claude 的文字浮水印將直接在模型產生文字時加入,而非網站或應用程式事後附加。這意味著,只要使用支援標記的 Claude 模型,透過 Claude、Claude Platform API、Claude Code、Claude Cowork 或 Claude Tag 取得的文字都會帶有標記。Anthropic 表示,浮水印不會顯示在畫面上,也不影響文字原意與閱讀,而文字複製貼上到其他地方後,標記仍可能保留下來。
生成檔案標記
生成檔案採用不同做法。Claude 產生支援格式的檔案時,會加入符合 C2PA 開放標準、經數位簽署的來源中繼資料,記錄內容來源資訊,讓系統檢查檔案是否帶有可驗證的來源資訊,以及檔案之後是否遭到竄改。
影響分析
找到 Claude 標記不代表內容一定全部由 Claude 創作,使用者要是只是透過 Claude 校稿、翻譯或摘要既有內容,處理後的文字仍可能帶有標記。相反,偵測不到標記,也不能直接認定內容沒有經過 AI 處理。文字經大幅改寫或翻譯、篇幅太短,以及檔案轉換、重新儲存或截圖造成來源資訊被移除,都可能使標記無法辨識。
未來展望
Anthropic 也正替 8 月 2 日前推出的既有 Claude 模型加入標記支援,目前尚未公布完成時間。文字浮水印採用的具體技術及偵測方式也還沒有公開,Anthropic 表示後續將發布技術文件,說明使用者及第三方如何檢查 Claude 產生內容中的相關標記。這項標記機制的推出將對 AI 生成內容的透明度和可靠性產生重大影響,同時也為 AI 研發和應用提供了一個新的方向。
