2026年8月29日星期六

WhaleAgent
Anthropic 為 Claude 輸出加隱形浮水印

Anthropic 為 Claude 輸出加隱形浮水印

Anthropic 宣布 Claude 產生的所有文字將嵌入隱形浮水印,檔案輸出附上 C2PA 簽署來源資料。措施 8 月 2 日起全球生效,源於歐盟人工智能法案第 50 條的透明度要求。

Anthropic 於 8 月 11 日宣布,Claude 產生的所有文字將嵌入隱形浮水印,圖像與檔案輸出則附上符合 C2PA 標準的簽署來源資料。措施由 8 月 2 日起生效,並在全球一律適用,不限於歐盟用戶。

具體做了甚麼

文字方面,浮水印是不可見的標記,按 Anthropic 的說法,不會改變回應的意思、質素或可讀性。它的設計目標是在複製貼上之後仍然保留,換言之,把 Claude 的輸出貼進另一個文件,標記理論上會跟著過去。

檔案方面走的是另一條路。以 .svg、.png、.jpg 格式產生的檔案,會附上經數碼簽署的中繼資料,遵循 C2PA(Coalition for Content Provenance and Authenticity)標準。這套標準由業界聯盟制定,用於記錄一份檔案的產生與編輯歷程。

兩者的分別在於:文字的標記藏在內容本身,檔案的標記藏在中繼資料。前者較難移除,後者較易在轉檔或重新儲存時消失。

歐盟法規要求甚麼

驅動力來自歐盟人工智能法案第 50 條。條文要求產生合成內容的 AI 系統,必須把輸出標示為人工生成,deepfake 是最常被引用的例子。按時間表,2026 年 8 月 2 日起在歐盟推出的新模型,需要在推出當日即支援內容標示。

值得注意的是適用範圍。法規的管轄對象是歐盟市場,但 Anthropic 選擇全球一律套用,而非只對歐盟用戶開啟。這是合規工程上常見的取態:與其按地區維護兩套輸出管道,不如以最嚴格的一套為準,減少出錯與維護成本。

浮水印能證明甚麼、不能證明甚麼

這一點比措施本身更值得留意,而 Anthropic 自己也說得相當直白。

第一,標記並非牢不可破。大幅改寫或翻譯之後,浮水印有可能無法再被偵測。文字愈短、改動愈多,殘留的訊號就愈弱。

第二,也是更重要的一點:偵測到標記,只代表該內容曾經過 Claude 處理,並不等於證明了完整的來源或作者身分。一段由人撰寫、再交給 Claude 潤飾的文字會帶有標記;一段由 Claude 產生、再經人手大幅改寫的文字則可能不帶標記。

所以這套機制的實際用途,是為平台與監管方提供一個機率性的訊號,而不是一份可以直接用作裁決的證據。把它理解為「查得到就一定是 AI 寫的」,或者「查不到就一定不是」,兩種讀法都不成立。

來源

No comments yet