Anthropic正在為其旗下Claude系列AI模型引入機器可讀標記技術,所有由Claude生成的文本將被嵌入隱形水印,圖片等文件則附加經數字簽名的溯源元數據。這一舉措標誌着AI內容透明度監管進入實質落地階段。

根據Anthropic在8月11日發布的官方說明,該水印直接編織於文本內容本身,而非附加在元數據層面,這意味着文本被複制粘貼至其他平台後水印依然隨之傳播,並可能在經過部分編輯後仍然留存。這一特性使得AI生成內容的追蹤能力大幅提升,超越了此前依賴元數據標註的同類方案。
上述計劃的直接觸發因素是Anthropic簽署了歐盟《人工智能法案》第50條第2款《AI生成內容透明度行為準則》。依據該準則,2026年8月2日起在歐盟推出的新Claude模型須在發布之日起即支持內容標記。Anthropic同時表示,標記機制將在全球範圍內適用,覆蓋Claude所有產品線及合作雲平台,並非僅限於歐盟地區。
水印如何運作:嵌入文本,隨文流轉
Anthropic採用兩種互補技術對Claude生成內容進行標記。

其一為嵌入式文本水印。當受支持的Claude模型生成文本時,模型會將一個不可見的水印直接織入文本本身。該水印不會改變內容的含義、質量或可讀性,用戶無法通過肉眼察覺。由於水印屬於文本的組成部分,而非附加的元數據,其將隨文本的複製粘貼一同轉移,並可能在經歷部分編輯後依然保留。水印在模型層面施加,意味着無論通過哪個Claude產品或界面生成的文本,均會攜帶該標記。
其二為簽名溯源元數據。當Claude生成受支持的文件類型(如.svg、.png、.jpg等)時,將附加經數字簽名的溯源元數據。該元數據遵循內容溯源與真實性聯盟(C2PA)開放標準——這一標準已在業界廣泛採用,用於記錄內容來源信息。若簽名元數據標籤存在,則表明該文件經由Claude處理,並可用於檢測文件是否遭到篡改。
Anthropic明確,標記機制將覆蓋Claude旗下所有主要產品與接入渠道,包括Claude Platform(API)、Claude、Claude Code、Claude Cowork及Claude Tag,並適用於通過AWS、谷歌雲及Microsoft Foundry接入的雲合作伙伴。
在地域範圍上,標記將適用於Claude提供服務的所有地區,並不侷限於歐盟。
時間節點方面,2026年8月2日後在歐盟推出的新模型須從發布之日起即支持標記。對於此前已發布的現有模型,歐盟法規設有過渡期,Anthropic表示正在推進為這些模型補充標記支持,並將適時更新相關說明。
技術侷限:信號而非鐵證
Anthropic在官方說明中對水印技術的侷限性作出了明確披露,這對依賴該機制進行內容覈查的用戶和開發者而言尤為重要。
檢測到Claude標記,僅表明內容"可能"經由Claude處理,並不能完全確認內容的完整來源。
例如,Claude可能並非原始作者——用戶常藉助Claude進行校對、翻譯、摘要或文件轉換,輸出內容即便攜帶Claude標記,其底層思想、文字或數據也可能源自其他來源;此外,內容在經Claude處理後可能已被修改、節選或與其他材料合併。
反之,未檢測到標記,也不能證明內容並非AI生成。以下情形均可能導致標記缺失:內容由標記功能上線前發布的模型生成;文本經過大量編輯、改寫、翻譯或與其他內容混合;文本段落過短,不足以承載可靠信號;文件元數據在格式轉換、重新保存或截圖等操作中被剝離;或內容來自尚不支持特定標記類型的平台、功能或文件格式。
另外,Anthropic在說明中特別提示,在自有產品中部署Claude的開發者,應獨立評估《人工智能法案》第50條對其產品和服務的具體要求。Anthropic表示,其目標是支持開發者履行各自的透明度義務,並將在技術文檔就緒後發布關於標記與檢測方案的詳細指引。
這意味着,對於將Claude能力集成至下游產品的企業而言,AI內容標記合規責任並不因Anthropic的技術實現而自動轉移,開發者仍需主動釐清自身在相關法規框架下的義務邊界。