Claude 開始為每一個字加上浮水印:Anthropic 隱形標記機制深度解析
Anthropic 現在會在全球範圍內、且無法關閉的情況下,為所有 Claude 生成文字嵌入隱形機器可讀浮水印,並為生成檔案附加 C2PA 來源中繼資料——一切都是為了符合 8 月 2 日生效的 EU AI Act 第 50 條透明化規範。
如果你在 2026 年 8 月初之後用 Claude 寫過任何東西,那段文字現在已帶著一個你看不見的浮水印。Anthropic 本週證實:2026 年 8 月 2 日(含)之後發布的 Claude 模型,會在生成的每一段文字中嵌入隱形、機器可讀的浮水印,並為生成的檔案附上加密簽署的來源中繼資料。這項政策全球適用、涵蓋所有產品介面、而且沒有退出選項。背後的推手是一項法律——EU AI Act 第 50 條透明化義務已於 8 月 2 日正式生效。但 Anthropic 的實作範圍其實超出了法規的最低要求,也因此在用戶社群引爆了該公司近年最激烈的反彈之一。
實際上線了什麼
根據 Anthropic 的官方支援文件,Claude 現在透過兩種互補的技術來標記輸出內容。
文字內嵌浮水印。 當支援的 Claude 模型生成文字時,它會「將一個難以察覺的浮水印直接織入文字本身」。Anthropic 表示這不會改變回應的意義、品質或可讀性。關鍵在於:浮水印是「文字的一部分」,而不是附加在中繼資料上——因此當使用者複製貼上時,浮水印會跟著文字一起轉移,且「可能在一定程度的編輯後依然留存」。浮水印是在模型層級套用的,這意味著無論文字來自哪個 Claude 產品或介面——Claude Platform API、Claude 應用程式、Claude Code、Claude Cowork、Claude Tag——它都存在。透過 AWS、Google Cloud、Microsoft Foundry 等雲端合作夥伴存取支援的模型時,浮水印同樣適用。
檔案的簽署來源中繼資料。 當 Claude 生成支援的檔案類型(如 .svg、.png、.jpg)時,會附上遵循 C2PA(Coalition for Content Provenance and Authenticity,內容來源與真實性聯盟)開放標準的簽署來源中繼資料——與 Google 和 Adobe 採用的系統相同。若存在簽署標籤,代表該檔案曾經 Claude 處理,且能偵測檔案是否在生成後遭到竄改。
一個值得注意的決定:Anthropic 是全球適用這套標記機制,而不僅限於歐盟用戶。此外,8 月 2 日之前發布的舊模型也正在回頭補上標記支援,只是尚未公布時間表——法律為這些舊模型設有過渡期。
背後的法律
這一切的催化劑是 EU AI Act 第 50 條,其透明化義務於 2026 年 8 月 2 日生效。規範要求生成式 AI 系統的提供者必須以機器可讀格式標記 AI 生成或合成的輸出,讓下游使用者、平台與監管機關能夠辨識。違規罰款最高可達 1,500 萬歐元,或公司全球年營業額的 3%,取較高者。(生成式 AI 系統在 2026 年 12 月 2 日前,仍需滿足第 50 條第 2 項的機器可讀標記要求。)
Anthropic 是歐盟《AI 生成內容透明化實務守則》(Code of Practice on Transparency of AI-generated Content)的簽署方。這份自願性合規框架於 2026 年 7 月定稿,簽署即可推定符合第 50 條。截至 7 月底,已有近 200 家公司簽署,包括 Microsoft、Google、Meta、OpenAI、Black Forest Labs 與 Synthesia。值得注意的缺席者:xAI。守則一般要求提供者對輸出實施多層機器可讀標記,並要求部署者加上可見標籤——同時推廣 C2PA 等開放標準與歐盟通用圖示。
浮水印如何運作
Anthropic 尚未公布完整技術文件,但其描述的機制與研究文獻中長期探討的統計式浮水印(statistical watermarking)相符。模型會根據 Anthropic 持有的金鑰,微妙地偏移它的選字傾向。任何單一選字看起來都平平無奇,但只要文字量夠多,持有驗證方法的人就能統計性地偵測出其中的模式。
這正是浮水印能在複製貼上後倖存的原因——訊號存在於用字選擇本身,而不是會在傳輸過程中被剝除的表頭或中繼資料區塊。這也解釋了它優雅衰減的特性:大幅改寫、翻譯、或與其他文字混合都可能洗掉訊號,而極短的段落可能沒有足夠文字量來產生可靠訊號。
C2PA 檔案中繼資料的運作方式則不同:它將一份數位簽署的來源紀錄附著在檔案上,簽章可以被驗證,以確認檔案在 Claude 生成後是否被修改過。但它可能透過重新儲存、格式轉換或截圖而被剝除——這正是兩套系統被設計成互補的原因。
Anthropic 表示將釋出偵測工具,讓使用者與第三方能檢查文字或檔案是否帶有 Claude 標記,並附上技術文件——但目前都尚未公開。
Anthropic 自己列出的但書
這份支援文件對偵測結果的意義異常坦白。偵測到標記只代表內容「可能曾經 Claude 處理」——僅此而已。Claude 未必是原作者:人們常用它校對、翻譯、摘要或轉檔,這類輸出可能帶有標記,即使底層的想法與文字源自他處。標記說的是 Claude「碰過」它,而不是 Claude「寫了」它。
反過來說,沒有偵測到標記也不能證明是人類創作。內容可能因為來自 8 月前的舊模型、被大幅編輯、篇幅太短、或中繼資料被剝除而沒有可偵測的標記。Anthropic 也提醒在自己產品中部署 Claude 的開發者,應自行評估第 50 條對他們的要求。
用戶反彈
這次上線確實引發了激烈的分歧。在 X 和 Reddit 上,用戶稱這項政策「問題極大」,有人回報因此取消訂閱。反對意見主要聚焦在幾個面向:
- 誤導性指控。 一份由本人撰寫、僅用 Claude 輕度潤飾的文件,可能被偵測為陽性——而目前沒有公開的準確率門檻,也沒有爭議結果的申訴程序。
- 署名與功勞歸屬。 用 Claude 編修自己作品的作家與學者,如今得面對作品帶著一個他們從未同意的 AI 標記。
- 無法驗證的主張。 Anthropic 斷言浮水印不影響輸出品質,卻未公布實作細節,用戶無從獨立驗證這點。
- 開發者疑慮。 程式設計師擔心加密簽章與統計偏移可能對生成程式碼及軟體管線造成問題。
還有一個競爭上的諷刺:《華爾街日報》報導指出,OpenAI 多年前就具備為 ChatGPT 文字加上浮水印的技術能力,卻因誤判率和競爭風險等顧慮而按兵不動。如今 Anthropic 在法規期限的驅動下跨出了這一步,可能迫使整個產業跟進。AI 音樂平台 Suno 上週在一連串法律挑戰後開始標記平台上的生成音軌;Substack 也在 7 月與偵測公司 Pangram 合作標記 AI 內容。
為什麼重要
這是前沿實驗室首次在如此規模上部署文字浮水印——全球適用、無法關閉。它把一項研究等級的技術變成了生產環境的基礎設施,也讓 EU AI Act 的透明化機制,對數百萬永遠不會去讀那部法規的用戶變得具體可感。那些懸而未決的問題——偵測工具、準確率、爭議處理程序、舊模型的回補時間表——將決定這究竟會成為一層值得信賴的來源驗證機制,還是一個持續引爆爭議的火藥桶。可以確定的是:從現在起,Claude 寫下的每一個字,都帶著一個我們大多數人看不見的簽名。
Sources
- [1] https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- [2] https://techcrunch.com/2026/08/11/anthropic-says-it-will-watermark-text-generated-by-its-ai-models/
- [3] https://www.forbes.com/sites/anishasircar/2026/08/13/claude-will-now-leave-a-watermark-on-everything-it-writes-what-does-that-mean/
- [4] https://www.theverge.com/ai-artificial-intelligence/977823/anthropic-claude-ai-watermarks-c2pa-text-images
- [5] https://digital-strategy.ec.europa.eu/en/policies/code-practice-ai-generated-content
- [6] https://artificialintelligenceact.eu/transparency-rules-article-50/