Anthropic 已闡明其計畫如何為 Claude 生成的文字應用隱形浮水印,以符合歐洲的 AI 透明度規範。Anthropic 週五宣布,Claude 的文字標記系統是「SynthID-Text 方法的一個版本」,這是一項由 Google DeepMind 開發的開源浮水印技術,它利用詞彙機率來創建可偵測的模式。
這項浮水印功能,連同對 Claude 處理圖片的 C2PA 支援,旨在履行 Anthropic 在歐盟 AI 法案下的義務。該法案要求合成音訊、圖像、影片和文字必須包含機器可讀的標記,以便內容能被偵測為人工生成或操縱。Anthropic 表示,文字浮水印不會讓用戶使用 Claude 的成本更高,也不會「對 Claude 輸出的品質或內容產生任何實際影響」。
以下是 Anthropic 對其運作方式的解釋:以句子「今天天氣很冷,而且…」為例。下一個詞不太可能是「甜的」,但很有可能是「陰天」或「灰色」。在大多數情況下,模型最終選擇這兩個詞中的哪一個對讀者來說並不重要,因為句子的意思大致相同。在這種情況下,選擇是由一個隨機數決定的。
浮水印技術利用這些「低風險選擇」(在一段生成文字中會出現多次)在 Claude 的回應中留下一個模式。這個模式對讀者來說是不可偵測的,但對於擁有編碼金鑰的人來說卻是可偵測的。當使用浮水印時,選擇仍然是隨機進行的,但隨機性的來源不同。它不再使用任意的隨機數生成器來選擇下一個詞,而是利用金鑰和前面幾個詞來決定模型應該選擇哪個詞。
正如 Anthropic 所指出的,歐盟的 AI 透明度要求也影響其他主要的 AI 開發商,因此 Claude 不會是唯一一個導入文字浮水印的模型。Google 的 Gemini 聊天機器人自 2024 年起就已支援 SynthID-Text 解決方案,而 OpenAI 雖然尚未在其 AI 法案合規路線圖中詳細說明 ChatGPT 的任何文字浮水印計畫,但它也將受到該法律要求的約束。



