Anthropic 開始在 Claude 所有輸出植入隱形浮水印
Claude 產生的文字現在內建可抵抗複製貼上的機器可讀浮水印——Anthropic 為符合歐盟 AI 法案透明化規範而全面啟用,網路輿論為之譁然。
2026 年 8 月 2 日之後推出的每一款 Claude 模型,現在都會在產生的文字中直接嵌入一種隱形、機器可讀的浮水印。Anthropic 本週證實這項政策,而且適用範圍是全球——不只歐洲——使用者無法選擇退出。這是大型前沿實驗室首次在整個生產線上部署持久性文字浮水印,也在 AI 社群掀起了今年最激烈的反彈聲浪之一。
Anthropic 到底宣布了什麼
這項政策源自《AI 生成內容透明化實務守則》(Code of Practice on Transparency of AI-Generated Content),也就是歐盟 AI 法案第 50 條的落實框架——該條文的透明化義務已於 2026 年 8 月 2 日起正式適用。Anthropic 是 7 月底前簽署守則的近 200 家公司之一,同批簽署者還包括 Meta、Microsoft 與 OpenAI。
具體機制如下:
- 文字輸出:新款 Claude 模型的所有文字都織入隱形浮水印。由於標記是文字本身的一部分,用 Anthropic 的話說,它會「隨文字複製貼上到別處時一起帶走」,且能在一定程度的編輯後存活。
- 檔案:模型產生或處理的 SVG、PNG、JPG 等檔案,將附上遵循開放 C2PA 標準的數位簽章來源中繼資料,可偵測竄改。
- 涵蓋範圍:Claude 應用程式、API、Claude Code、Claude Cowork,以及透過 AWS、Google Cloud、Microsoft Foundry 等雲端夥伴提供的服務,只要該模型與功能支援對應的標記方式即適用。
- 偵測工具:供使用者與第三方使用的偵測工具正在開發中;偵測流程的技術細節尚未公布。
- 舊模型:8 月 2 日前發布的模型有過渡期——Anthropic 表示會補上標記支援,但沒有給出時間表。
Anthropic 也刻意說明了限制:偵測到浮水印並不代表內容「完全由 AI 生成」——人類可能寫了原文,只讓 Claude 校對、翻譯或摘要。反過來,沒偵測到標記也不能證明什麼:重度改寫、翻譯、過短的段落,或透過截圖、轉檔等方式去除中繼資料,都可能讓偵測失效。
為什麼是現在:歐盟 AI 法案第 50 條的期限
時機並非巧合。歐盟 AI 法案第 50 條要求生成式 AI 業者以機器可讀方式標記合成內容,讓下游使用者與平台能夠辨識。這項義務自 2026 年 8 月初起可執行,而伴隨的實務守則——由產業共同參與起草——就是合規的實務路徑。
Anthropic 選擇全球部署而非僅限歐洲使用者,避開了過去合規措施常見的碎片化問題:只在歐盟流量出現的浮水印不僅容易被繞過,維護上也彆扭。單一全球實作更乾淨,Anthropic 也明言此作法適用於「Claude 提供服務的所有地方」。
而且這不是第一家的水印。Google 自 2023 年起就為 AI 生成圖片加上浮水印(SynthID),之後擴及文字、音訊與影片。OpenAI 的圖片也早有隱形浮水印。真正的差異在文字:據《華爾街日報》報導,OpenAI 手上的 ChatGPT 文字浮水印技術存在多年,但內部對誤判、被繞過、以及可能把使用者推向競爭對手的顧慮,讓它一直被雪藏。Anthropic 成了第一家在生產環境跨出這一步的大型實驗室。
反彈聲浪:校稿族與程式設計師群起反抗
消息公布幾小時內,X 與 Reddit 炸鍋。使用者稱之「問題重重」,並宣告「無法證明是 AI 寫作的時代」終結。反彈主要來自兩個群體。
第一種:把 Claude 當編輯而非作者的族群。廣播主持人兼部落客 Erick Erickson 在 X 上的總結最有代表性:「我捨棄 Grammarly 改用 Claude 校稿,因為它做得更好。但現在我自己寫的東西會被蓋上『Claude 做的』浮水印。這太荒謬了。」對這群人來說,浮水印像是一份不實的自白——一份長久存在、暗示作品主要由機器完成的標記,加在實際上大多(或完全)出自自己之手的文字上。
第二種:開發者。程式設計師擔心在生成的程式碼裡嵌入密碼學訊號會「降低輸出品質」、引入細微的雜訊,或更令人不安的——讓他們的程式庫永久可被掃描出「AI 協助」痕跡。如果未來招募人員或授權爭議可以標記你的 commit 歷史為機器輔助,那浮水印就成了內建於工具鏈的職業風險。
這項宣布也重新點燃了關於「功勞歸屬」的哲學論戰。一位 Reddit 使用者主張,AI 輔助作品的功勞屬於人類使用者:「我下了指令、給了脈絡、做了決策和無數次修正,Claude 只是工具。」另一派則完全反過來:「作品是 Claude 創造的,你只是下指令……如果主管給你專案指令,事後卻把功勞 100% 攬在自己身上,你也會不爽,不是嗎?」
實務上意味著什麼
對企業來說,這項改變大體上是合規利多。需要證明 AI 內容來源的可監管產業,現在從一線供應商預設取得這個能力,還有能在一定程度下存活的簽章 C2PA 中繼資料。
對個人使用者而言,取捨是真實的。浮水印無法區分「Claude 寫的」和「Claude 潤稿的」——這是 Anthropic 自己承認的限制。混合人類草稿與 AI 協助的寫作者,會帶著誇大機器角色的標記。而且偵測細節尚未公開,第三方還無法審計系統的誤判行為——而這正是讓 OpenAI 同等技術始終無法上線的核心顧慮。
技術現實也比新聞標題脆弱。文字浮水印在改寫與翻譯下會衰減;C2PA 中繼資料一張截圖就死。有決心的攻擊者會清除標記;一般使用者不會。這種不對稱其實正是重點——第 50 條針對的是大規模合成媒體與深偽傳播,不是對抗性內部人員。
話雖如此,先例很重要。如果 Anthropic 的部署撐過這波反彈、偵測工具也證實可靠,OpenAI 與 Google 全球推出文字浮水印的壓力將會升高——布魯塞爾的監管者肯定會問:為什麼同樣簽了守則,一家在生產環境做到了,其他家沒有。「無法證明是 AI 寫作」的時代或許真的在結束。但這終究是在保護讀者,還是在監控寫作者?這正是現在網路上吵翻天的問題,短期內不會有答案。
結論
Anthropic 做了所有前沿實驗室中最大膽的透明化行動:新款 Claude 模型的所有文字內建隱形、抗複製貼上的浮水印,全球適用、無法退出,檔案則附帶 C2PA 來源標記。它滿足了歐盟 AI 法案,卻也引發校稿者與開發者對公平性的真實疑慮,並迫使產業塵封已久的文字浮水印之爭浮上檯面。接下來看兩個訊號:Anthropic 偵測工具的發布,以及 OpenAI 是否終於拿出自己雪藏多年的浮水印作為回應。