← All posts / Policy

Anthropic 為所有 Claude 文字嵌入隱形浮水印:EU AI Act 透明度規則正式上路

2026 年 8 月 2 日後發布的新版 Claude 模型,將在全球範圍內為所有生成的文字嵌入機器可讀的隱形浮水印,Anthropic 同步簽署 EU AI Act 第 50 條透明度行為準則。

Anthropic 為所有 Claude 文字嵌入隱形浮水印:EU AI Act 透明度規則正式上路

2026 年 8 月 2 日,這個日子刻入了每一家在歐洲營運的生成式 AI 公司的合規行事曆。這一天,歐盟人工智慧法案(EU AI Act)第 50 條正式生效,要求生成式 AI 系統的提供者標記其機器生成的內容——讓下游接觸到這些內容的人,無論是在社群平台、企業文件,還是客服對話中,至少能知道自己正在看什麼。同一天,Anthropic 確認已簽署 EU AI Act 第 50 條第 2 項「AI 生成內容透明度行為準則」(Code of Practice on Transparency of AI-Generated Content),並已開始在其最新 Claude 模型生成的每一份內容中嵌入隱形、機器可讀的浮水印。

Anthropic 打造了什麼

這套系統建立在兩個互補的支柱上。第一個是隱形文字浮水印,直接在模型層級編織進 Claude 生成的文字中。不同於附加在回應結尾的可見標籤,或藏在 API 負載中的元資料欄位,這個訊號存在於文字本身——人眼正常閱讀時看不見,但在使用者複製、貼上、分享時會持續存在。Anthropic 表示浮水印設計上能在許多情況下承受編輯、改寫、甚至翻譯,但公司也坦承重度加工可能將訊號削弱至低於可靠偵測的門檻。

第二個支柱涵蓋檔案。Claude 生成的圖片及其他支援的檔案格式現在攜帶基於 C2PA(內容來源與真實性聯盟,Coalition for Content Provenance and Authenticity)標準的簽署來源元資料。有效的 C2PA 清單會以加密方式記錄 Claude 處理過該檔案,並能標示是否有人後續竄改了來源鏈。這是 Adobe、Microsoft、BBC 等機構用於內容憑證的同一套標準——它讓 Claude 產出的檔案擁有一個機器可讀的身分,至少在某人透過格式轉換、截圖或重新儲存來剝除元資料之前。

關鍵的是,標記是全球適用的——不僅限於歐盟境內的使用者。2026 年 8 月 2 日當日或之後發布的 Claude 模型,在 Claude 提供服務的所有介面上都會嵌入這些訊號:Claude Platform API、Claude 消費者應用程式、Claude Code、Claude Cowork 以及 Claude Tag。透過 AWS、Google Cloud 和 Microsoft Foundry 存取 Claude 的雲端客戶也會收到帶有標記的輸出。這種全球適用反映了 Anthropic 的立場:在模型層級實施一次統一的浮水印,比根據使用者的地理位置來開關要簡單得多。

第 50 條為何重要

EU AI Act 第 50 條對 AI 系統的提供者和部署者施加了四項不同的透明度義務。對於生成式模型的提供者而言,核心要求是確保合成內容——文字、圖片、音訊、影片——以機器可讀的方式標記,且可被偵測為人工產出。合規期限為 2026 年 8 月 2 日,並對在此日期前已部署的系統設有過渡期。

Anthropic 簽署第 50 條第 2 項行為準則——這是歐盟執委會與產業利害關係人共同制定的自願性框架,為企業提供具體的合規路徑——使其成為首批公開承諾透明度標準的主要模型提供者之一。行為準則涵蓋內容標記的技術措施、供第三方使用的偵測工具,以及限制的文件說明。

對 Anthropic 而言,戰略邏輯是雙重的。首先,合規對任何想服務歐洲客戶的公司來說都不是可選項;問題一直是「如何做」,而非「是否做」。其次,透過積極推進浮水印並發布偵測文件,Anthropic 可以合理主張 Claude 是市面上最透明的前沿模型——這項聲譽優勢在企業進行 AI 供應商風險評估時至關重要。

技術現實:什麼留得下來,什麼留不下來

Anthropic 自己的說明文件對這些標記能做什麼、不能做什麼,態度出乎意料地坦誠。浮水印在多種情境下可能無法被偵測到:文字經過大量編輯、改寫、翻譯或混入其他寫作時;段落太短以至於無法產生可靠的統計訊號時;或輸出來自標記功能支援前發布的舊模型時。檔案來源面臨自身的脆弱性——任何透過格式轉換、截圖或重新儲存的元資料剝除都可能完全摧毀 C2PA 清單。

這種誠實之所以重要,是因為它設定了合理的預期。浮水印最好被理解為一個機率性訊號,而非作者身分的密碼學證明。偵測到陽性結果告訴你 Claude 可能在某個時間點處理過這段文字,但這並不證明整篇文章都是 AI 生成的——Claude 可能只是翻譯、摘要或編輯了人類撰寫的原始素材。反過來說,陰性結果也不證明內容是人類寫的;它可能只是意味著浮水印已被削弱,或文字來自未標記的模型。

正如一位分析師指出的,有用的思考框架不是「AI 還是人類?」,而是「有沒有一個我能採取行動的訊號?」一張帶有 C2PA 簽署的 Claude 圖片給了內容審核人員一些可以據以制定政策的具體依據。相比之下,一篇未標記的文章什麼也提供不了——這正是為什麼浮水印的缺席永遠不應被視為人類創作的證明。

對開發者與企業的影響

對於在 Claude 之上建構產品的組織而言,浮水印的推出既帶來義務,也帶來機會。Anthropic 的指引很明確:如果你在自己的產品中部署 Claude,你必須獨立評估第 50 條對你特定使用場景的要求。模型層級的浮水印支援你下游的透明度義務,但不會自動滿足這些義務——你仍然有責任決定內容如何被標記和呈現給終端使用者。

該公司已承諾發布偵測 Claude 浮水印的技術文件,包括第三方——查核人員、平台、研究人員——可用來檢查內容是否帶有 Claude 標記的工具。這與某些競爭對手的封閉做法形成顯著對比,並可能圍繞 Claude 輸出建立一個偵測生態系,迫使其他提供者跟進。

對企業而言,浮水印在 AI 治理中引入了新的變數。內容歸因工作流程、抄襲偵測系統和來源追蹤管線可能需要更新,以識別 Claude 特定的訊號格式。評估可疑電子郵件或社群貼文是否為 AI 生成的安全團隊現在多了一個資料來源——但他們應記住,Claude 的浮水印只是眾多提供者中的一個,而惡意行為者自然會轉向未標記的替代方案。

更廣泛的競賽

Anthropic 並非孤軍奮戰。OpenAI 已為 DALL-E 圖片探索浮水印技術,並在文字來源方面面臨持續壓力。Google 的 SynthID 涵蓋 Gemini 和 Imagen 的文字、圖片及音訊輸出。Meta 已承諾在其平台上為 AI 生成的媒體加上 C2PA 標籤。但 Anthropic 決定從新模型發布首日起,在模型層級全球適用文字浮水印——並公開簽署 EU 行為準則——設定了合規標竿,將產業對話從「我們應該加浮水印嗎?」轉向「你的浮水印有多好?」

文字浮水印問題從根本上比圖片或音訊來源更困難。圖片可以嵌入在壓縮後仍能存活的不可感知像素級擾動。文字的自由度要少得多——每個選詞和句法決策必須同時產生連貫的語言並編碼可偵測的統計特徵。批評者長期以來認為文字浮水印透過改寫就能輕易移除。Anthropic 的回應本質上是:我們同意它不完美,但部分訊號總比沒有好,而且法規義務無論如何都存在。

隨著歐盟的執法機制加速建置,以及其他司法管轄區——英國、中國,以及潛在的美國——發展各自的透明度要求,Anthropic 在模型層級標記的早期投資,可能證明是 AI 來源時代最具影響力的基礎設施決策之一。那個你看不見的浮水印,最終可能形塑數位信任的規則好幾年。