Anthropic 已簽署歐盟 AI 法案關於 AI 生成內容透明度的行為準則。從 2026 年 8 月開始,新的 Claude 模型將在文字中嵌入浮水印,並為檔案附加數位簽章的來源中繼資料。
於 2026 年 8 月 2 日或之後在歐盟推出的 Claude 模型將內建此標示功能。這項要求也不會僅限於歐盟境內,它將全球適用於所有 Claude 產品,包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag。
生成的文字將帶有嵌入式浮水印,而生成的檔案則會獲得數位簽章的來源中繼資料。現有模型在法律上享有過渡期,但 Anthropic 表示他們已在著手進行改造。
該公司還計劃發布驗證工具,讓用戶和第三方能夠檢查這些標示,儘管目前尚未公布具體時間。Anthropic 表示,將 Claude 整合到其產品中的開發者必須自行判斷其服務適用哪些《歐盟 AI 法案》第 50 條的要求。
Anthropic 計劃使用兩種標示方式。根據該公司說法,Claude 生成的文字將帶有隱形浮水印,不會影響其意義、品質或可讀性。此浮水印在複製貼上後仍能保留,並且「可能在經過部分編輯後依然存在」。由於它是在模型層級應用,因此無論使用哪種 Claude 產品都會有。
支援的檔案,包括 .svg、.png 和 .jpg 圖像,將帶有基於開放 C2PA 標準的數位簽章來源中繼資料,該標準由內容來源與真實性聯盟(Coalition for Content Provenance and Authenticity)開發。
此簽章表明檔案已由 Claude 處理,並能揭示後續的竄改。文字浮水印也應能透過 AWS、Google Cloud 和 Microsoft Foundry 等雲端合作夥伴運作,儘管這些平台可能不支援數位簽章中繼資料。
Anthropic 對其限制坦誠以告。偵測到浮水印並不代表內容完全由 Claude 撰寫。人們經常使用 Claude 進行校對、翻譯或摘要,因此即使想法源自人類,輸出內容仍可能帶有浮水印。
沒有浮水印也無法完全釐清狀況。模型可能在浮水印功能推出前就已發布,文字可能經過大量編輯或翻譯,段落可能太短而無法可靠偵測,或者中繼資料可能在格式轉換或螢幕截圖時被移除。
真正的考驗在於這些浮水印在編輯、重新格式化和翻譯後能保留多久。如果它們能持續存在,檢查已知浮水印應該比 Pangram 等工具更可靠,因為後者的專有偵測方法並未揭示觸發結果的原因。第三方偵測器可以增加對 Anthropic 浮水印的支援,從而獲得更可靠的訊號。
Anthropic 並非孤軍奮戰。Google Deepmind 已開源其 SynthID 浮水印系統,並將其整合到 Gemini 模型中。SynthID 在 token 預測期間輕微調整機率值,以創建浮水印而不降低文字品質。它適用於多種語言,但對於生成後經過編輯的文字則效果不佳。
OpenAI 擁有一個準確度達 99.9% 的文字偵測器,但已擱置約兩年尚未發布。原因包括用戶可以透過翻譯或改寫輕易規避、可能污名化特定群體的風險,以及擔憂公開偵測器可能會損害 OpenAI 自身的業務。
這種風險在教育領域尤其嚴重,不可靠的偵測器可能導致錯誤的作弊指控。同時,也有充分的理由希望了解 AI 的使用時間和程度。研究表明,過度依賴 AI 工具會削弱批判性思維和寫作能力,尤其是在將其視為捷徑而非學習輔助工具的學生中。這個問題也超越了學術界,現在詐騙者甚至在美國大學註冊假學生,並利用 AI 輕鬆完成課程並領取助學金。
Anthropic 的這項決定也可能影響其業務。Claude 在知識型工作,特別是學生群體中很受歡迎,因為即使是較舊的模型也能產生相當自然的散文。隨著學校和大學已經在學術工作中就 AI 使用問題爭論不休,更可靠的偵測可能會降低 Claude 對這些用戶的吸引力。



