重點摘要:
- Anthropic自2026年8月2日起在所有Claude文本輸出中嵌入隱形浮水印
- 全球部署由歐盟《人工智慧法案》第50條觸發,適用範圍超越歐洲用戶
- 偵測工具將提供給第三方,用於驗證Claude生成的內容
重點摘要:

2026年8月2日後生成的每一個Claude回應,都帶有偵測工具可讀取、但人類無法察覺的機器可讀指紋。
自2026年8月2日起,Anthropic推出的每一款新Claude模型都將在所有文本輸出中嵌入隱形浮水印,這是歐盟《人工智慧法案》第50條透明度要求所觸發的全球性部署。浮水印適用於Claude的所有介面——包括API、聊天介面、Claude Code、Claude Cowork和Claude Tag——並延伸至透過AWS、Google Cloud和Microsoft Foundry存取Claude的雲端客戶。
Anthropic的支援文件指出,浮水印「不會改變Claude回應的意義、品質或可讀性」,同時承諾協助「用戶及其他第三方偵測Claude的標記,如法案所要求」。該公司尚未公布其浮水印技術的詳細規格,用戶只能憑信任接受這項品質保證。
技術層面上,此做法涉及在生成過程中微幅調整模型的token選擇。模型並非始終選擇最可能的下一詞,而是根據某種統計模式略微偏好特定token,供偵測演算法日後識別。浮水印在文字被複製和貼上時會隨之遷移,並可能在某些編輯操作後仍然保留。對於影像檔案及其他支援格式(包括SVG、PNG和JPG),Anthropic則依照C2PA開放標準附加簽章來源後設資料,為視覺內容建立第二層追蹤機制。
這套全球浮水印機制創造的競爭動態已超越合規範疇。Anthropic已依據第50(2)條簽署歐盟《實務守則》,違規最高可處以1500萬歐元罰款或全球年營業額的3%。此舉對OpenAI和Google DeepMind構成壓力——後者開發了用於標記AI生成內容的SynthID——促使它們加速自身的浮水印部署,同時也為企業在評估供應商時提供了新的考量因素,因為企業需要在透明度要求與輸出彈性之間進行權衡。
這項部署之所以引人注目,在於其覆蓋範圍。歐盟《人工智慧法案》在技術上僅適用於服務歐洲用戶的供應商,但Anthropic卻在全球範圍內為輸出加上浮水印。在8月截止日前推出的模型,將在歐盟寬限期內獲得「過渡性標記支援」,對於已上市系統,寬限期延續至12月2日。
關於大型語言模型浮水印的學術研究已記錄了品質取捨的問題:愈難移除的浮水印,愈可能降低輸出品質,尤其是當模型對其生成的內容信心不足時。IBM研究人員曾指出,某些浮水印方法需要變通做法才能保持文本聽起來自然。由於Anthropic未公布技術細節,其宣稱的做法能避免這些問題的說法仍未經證實。
對企業用戶而言,影響相當重大。使用Claude進行代筆寫作、內部草稿或內容管線的公司,若希望輸出來源保持中立,現在將生成帶有非其自行放置之識別碼的文本。平台、出版商或監管機構可能使用偵測工具將內容追溯至Claude,形成付費客戶無法選擇退出的合規層。
Anthropic並非AI浮水印領域的首位先行者。Google DeepMind的SynthID自2023年起已開始標記AI生成的文本、影像和音訊。OpenAI曾討論過浮水印方案,但在廣泛部署上進展較慢。Anthropic做法的獨特之處在於其對第三方偵測存取的明確承諾——任何持有Anthropic偵測工具者都能驗證文本是否由Claude生成。
Anthropic計劃在其偵測系統成熟後公布技術文件。在此之前,浮水印機制建立在信任基礎上:用戶必須接受系統如所述般運作,卻無法獨立驗證。對於評估AI供應商的企業而言,取捨如今已明確——對監管機構的透明度,以用戶輸出匿名性為代價。
本文僅供參考之用,不構成投資建議。