Anthropic宣布新版 Claude模型全面導入隱形文字浮水印,符合歐盟 AI法案規範
發布時間:
為遵守歐盟《人工智慧法案》(EU AI Act)第50條針對人工智慧內容透明度所訂定的嚴格規範,人工智慧開發商 Anthropic 正式宣布,自 2026 年 8 月 2 日起,所有新推出的 Claude 模型均會在生成的文字內容中,強制嵌入機器可讀的隱形浮水印。這項政策將在全球各個服務平台全面上線並適用,涵蓋範圍包含一般大眾使用的 Claude.ai 網頁版,以及針對開發者與企業端提供的 API 服務、Claude Code 程式碼輔助工具與 Claude Cowork 等企業應用環境。
過去網路社群曾一度流傳,人工智慧的文字浮水印是透過插入零寬度隱形字元,或是強制模型使用特定句型(例如「isn't X, it's Y」)來作為識別標籤。對此,Anthropic 官方特別澄清,Claude 導入的文字浮水印是採用模型層級的統計學選詞機制,其核心原理與 DeepMind 開發的 SynthID-Text 技術十分相似。這項技術完全不會在生成的文字中加入任何隱藏的 Unicode 字元、零寬字元或可見的視覺標記,同時也不會增加運算時的 Token 消耗量,更不會拖慢模型的生成速度。

關於浮水印的實際運作原理,官方解釋,當大型語言模型在逐字(Token)生成內容時,經常會面臨多個語意合理且機率相近的候選詞,這在技術上稱為高熵選擇狀態。Claude 的浮水印機制會保持這些候選詞的陣列及其原始機率分佈不變,但會利用一組系統內部的「秘密金鑰(Secret Key)」結合已經生成的前文進行雜湊運算。系統接著會以運算產生的偽隨機數,取代傳統的隨機數生成器來決定最終的選詞結果,將浮水印訊號無形地編碼在字詞的選擇序列中。
由於浮水印是隱藏在選詞機率中,其檢測過程必須高度仰賴統計模式。在單一詞彙或簡短的句子中,選詞結果不會顯示出任何異常;但當文字累積到足夠的長度後,選詞特徵就會浮現出特定的數學規律。此時,擁有專屬金鑰的專用檢測工具就能透過比對這些規律,精準計算出該段文字由 Claude 參與生成的機率。官方測試顯示,這類文字浮水印具備一定的韌性,不僅可以隨著使用者的複製貼上動作完整轉移,也能夠抵禦輕微的文字編輯與修改。
儘管具備技術優勢,浮水印機制仍有其限制。如果生成的內容後續經過人類大量改寫、跨語言翻譯、混合其他來源的文字,或者內容本身屬於事實問答、數學公式等可選詞空間極小的低隨機性領域,浮水印的訊號就會顯著衰減,甚至導致無法檢出。Anthropic 強調,成功檢出浮水印僅能代表 Claude 曾參與該段內容的生成或編輯潤稿,無法作為整篇文章全由人工智慧創作的絕對證明。此外,浮水印的編碼中絕對不包含使用者的個人隱私或任何身分識別資訊。至於 2026 年 8 月 2 日前發布的舊款 Claude 模型何時會補齊這項功能,以及第三方檢測 API 與技術文檔的具體上線日期,官方目前尚未提供確切的時程表。


