生活分享

Claude 文字浮水印上路:改的是選字的隨機來源,不是在文字裡藏東西

2026 年 8 月 15 日(台北時間;官方頁面印的是 2026 年 8 月 14 日),Anthropic 宣布未來的 Claude 模型產生的文字會帶浮水印,用來遵守歐盟 AI 法案的標記義務。做法是改變選字時的隨機來源,不在文字裡加東西、不含身分資訊;偵測 API 是私有預覽,只開放給歐盟法規要求的合資格組織,一般讀者現在查不到(2026 年 9 月查證)

閱讀時間約 10 分鐘

原創插圖:一整排代表文字的直條裡,其中幾條被替換成極小的鑰匙圖案,象徵浮水印藏在選字的隨機性裡而不是額外加上的符號,畫面不含任何商標或人像。
圖片:Mokaair (© Mokaair)

Anthropic 官方頁面上印出的發布日期是 2026 年 8 月 14 日,換算成台北時間則落在 2026 年 8 月 15 日凌晨。當天,Anthropic 在官網發布〈How Claude’s text watermark works〉,宣布未來的 Claude 模型產生的文字都會帶上浮水印,用途是判斷 Claude 有沒有可能參與了這段文字的寫作;這項改動與其他多家主要 AI 模型供應商一起進行,目的是遵守歐盟 AI 法案的規定。這一則在發布當時沒有排進本站的頭條批次,這一篇補上。

這一篇的資料在 2026 年 9 月 23 日查核,讀的是 Anthropic 這則公告全文、歐盟執委會對這份行為準則的公告,以及 Google DeepMind 團隊發表在《Nature》期刊的 SynthID-Text 論文;規格與限制的用字一律以官方原文為準,本站沒有獨立測試或驗證浮水印的偵測效果,也不提供任何購買或訂閱建議。

這是什麼:改的是選字,不是加字

Anthropic 把原理說明得很白話:模型逐字生成文字時,常常會遇到「換哪個字,意思都差不多」的低風險選擇——這種選擇本來由亂數決定,浮水印上路後改由一把金鑰、加上前面幾個字一起決定。這樣的選擇在一段文字裡會出現很多次,每一次都照著金鑰的規則挑字,於是整段文字留下一個讀者看不出來、但持有金鑰的人可以檢驗出來的樣式。

Anthropic 在頁面上逐條寫明這項技術不做的事:文字裡不會多出任何東西,沒有隱藏字元;不需要多花 token,因此不會比較貴;不含任何身分資訊,沒辦法回溯到特定的個人、組織或對話;讀者也分辨不出帶浮水印與不帶浮水印的文字有什麼差別,浮水印同樣不影響 Claude 輸出的品質。

這套做法不是 Anthropic 憑空發明的:頁面寫明,這是 Google DeepMind 團隊發表在 2024 年《Nature》期刊、名為 SynthID-Text 的做法的一個版本;再往前追,這一整類手法可以追溯到 Scott Aaronson 在 2022 年提出的構想,共同的設計原則都是只改變選字用的隨機性來源,不是在文字裡動手腳。其他簽署同一份行為準則的主要模型開發商,之後也會各自實作自己的浮水印。

為什麼現在做:歐盟 AI 法案的標記義務

這項改動的法源是歐盟的 AI 法案。Anthropic 寫明,自己與其他多家主要 AI 模型供應商,合計約 190 個簽署者,在 2026 年 7 月簽署了歐盟《AI 生成內容透明度行為準則》;歐盟執委會的公告也寫明,約 190 個組織在標記義務生效前簽署了這份準則——這個數字是截至 2026 年 7 月底的統計,執委會自己也寫這份名單之後還會更新。

歐盟執委會的公告寫明,這份準則分成兩節,分別對應生成式 AI 系統的「供應商」與「部署者」;法定義務只適用於供應商,但第一節也開放提供標記與偵測方案的業者一併簽署,標記義務本身自 2026 年 8 月 2 日起生效。

對台灣讀者來說,關鍵的一句話是 Anthropic 自己寫的理由:因為還沒有一套穩定的做法可以只在歐盟境內套用浮水印,所以發布時選擇全球一律套用。換句話說,這條規定管的是在歐盟市場提供服務的 AI 供應商,但只要用到帶浮水印的 Claude 模型,產生的文字一樣會有浮水印——這不是因為台灣被這條法律管到,而是 Anthropic 的技術做法還沒辦法只挑歐盟用戶套用。

整理自 Anthropic 公告與歐盟執委會 2026 年 7 月 31 日公告,查核日 2026 年 9 月 23 日。
項目內容依據
法源歐盟 AI 法案的標記義務Anthropic 公告
生效日2026 年 8 月 2 日Anthropic 公告
簽署時間與規模2026 年 7 月,Anthropic 等約 190 個組織(截至 7 月底)歐盟執委會公告
適用範圍發布時全球一律套用,因為還沒有穩定的分區做法Anthropic 公告

能不能自己查:偵測 API 現況

會不會被查出「這是 Claude 寫的」,答案是:一般讀者現在查不到。Anthropic 表示,偵測 API 目前是私有預覽(private preview),只開放給歐盟法律要求的合資格組織,頁面舉的例子包括主管機關、執法機關、媒體、事實查核者、獨立研究者、教育機構與歐盟公民社會團體,同樣依法負有查驗義務的企業也能取得;至於這個範圍以外的人要符合什麼條件、什麼時候排得到,頁面沒有寫,只表示之後會逐步擴大開放。

Anthropic 也提到,坊間像 Pangram 這類第三方 AI 偵測工具,用的是不同的方法——因為那些業者手上沒有 Anthropic 的金鑰,查的是行文留下的「痕跡」,跟拿金鑰核對浮水印本質上是兩回事。

原創插圖:四個方框由左至右排成一列並以細線相連,分別代表歐盟法規、選字機制、文字本身不變與偵測入口,畫面不含任何商標或人像。
圖解:歐盟 AI 法案自 2026 年 8 月 2 日起要求標記 AI 生成內容,Anthropic 的做法是改變選字的隨機來源,文字裡不加字元、不多花 token、不含身分資訊,而檢驗用的偵測 API 只開放給合資格組織。資料查核日 2026 年 9 月 23 日。 · 圖片:Mokaair (© Mokaair)

查得到也不是萬能:這個技術做不到什麼

就算是拿得到金鑰的合資格單位,浮水印也不是萬能。Anthropic 寫明,用金鑰只能回答「這段文字有多大可能部分由 Claude 寫成」,也就是 Claude 很可能在某個時點參與過,但分不出是 Claude 寫的還是 Claude 大幅編輯過的;這個結果不能確認文字是不是人寫的,也分辨不出是不是別的 AI 寫的;短樣本的偵測效果不好,段落越長,對 Claude 參與的信心才越高。

浮水印在不同類型的文字上也不平均:Anthropic 寫明,事實性段落因為可選的字比較少,浮水印比較稀疏;程式碼多半要求精確,帶的浮水印通常也比一般文字少,但註解這類可以自由選詞的地方仍然帶得到;浮水印也只套用在 Claude 自己選的字上——如果 Claude 只是校對別人寫好的文字,能留下浮水印的地方本來就很少。

耐久度上,Anthropic 寫明輕度編輯大概不會完全移除浮水印,但如果整段文字被逐字全部重寫,浮水印就會消失,同時補了一句:真到那一步,這段文字還算不算 AI 生成本身就有爭議;無論查不查得到,浮水印都不會改變文字的所有權或著作歸屬,也不會改變使用者依使用條款享有的權利。翻譯也一樣會帶浮水印,因為 Claude 翻譯出來的每個字都是 Claude 自己選的。

文字輸出用的是上面說的這套浮水印機制;Claude 產生圖檔(例如 .png、.jpg 這類格式)時走的是另一套機制,叫 C2PA 內容憑證,做法是在檔案的中繼資料附上一段加密簽章的說明,檔案本身完全不會被改動。Anthropic 特別強調這兩種做法「非常不同」,本站另有文章介紹過 C2PA 的查法,這裡不重複。至於 2026 年 8 月 2 日之前推出的舊模型,官方頁面寫明歐盟法律訂有過渡期,浮水印會在「未來幾個月」陸續補上,查核當天還沒有確切完成的日期。

讀者現在能做什麼、跟自己有什麼關係

查核到 2026 年 9 月 23 日為止,Anthropic 這則公告與歐盟執委會的公告都沒有提到台灣,公告談的是「Claude 及其輸出」,沒有特別區分 claude.ai 網頁版、Claude Code 或 API 各自的適用範圍。對一般台灣讀者來說,能確定的是:文字由帶浮水印的 Claude 模型生成時,適用的就是同一套規則;但因為偵測 API 不開放給一般人,讀者沒有辦法自己驗證這件事。

這一頁上也沒有寫使用者能不能自己關閉或退出浮水印,這是以 2026 年 9 月 23 日查核到的官方頁面沒有看到的說明,不是官方說「不能關」。頁尾另外寫明這頁在 2026 年 9 月 1 日更新過偵測 API 的說明,之後如果開放範圍或申請方式再改變,應該以 anthropic.com 當下的頁面為準,而不是查核當天記錄的內容。

歐盟這套透明度規則的全貌,以及台灣讀者該怎麼看待它,本站已有專篇整理;這裡談的是其中一家供應商實際怎麼做標記,不重講一次。

常見問題

Claude 的文字浮水印是不是像圖片浮水印那樣看得到?

不是。Anthropic 寫明文字裡不會多出任何東西,也沒有隱藏字元,讀者分辨不出帶浮水印與不帶浮水印的文字有什麼差別。

浮水印能不能查出是哪個帳號、哪一段對話寫的?

不能。Anthropic 寫明浮水印不含任何身分資訊,沒辦法回溯到特定的個人、組織或對話。

台灣使用者用 Claude,產生的文字也會有浮水印嗎?

官方頁面沒有提到台灣,但也寫明因為還沒有穩定的分區做法,發布時是全球一律套用;也就是說,台灣使用者不會因為不在歐盟而被排除,用到帶浮水印的 Claude 模型時,產出的文字一樣會帶浮水印。

查得出「這段文字很可能是 Claude 寫的」,代表什麼?

只代表 Claude 很可能在某個時點參與過這段文字,分不出是 Claude 寫的還是 Claude 大幅編輯過的,也不能確認是人寫的或別的 AI 寫的;短樣本、事實性段落、程式碼都可能查不出來,逐字重寫的文字則會查不出來。

一般人現在可以自己申請偵測 API 來查嗎?

不行。偵測 API 目前是私有預覽,只開放給歐盟法規要求的合資格組織,例如主管機關、執法機關、媒體、事實查核者、獨立研究者、教育機構與歐盟公民社會團體,以及同樣負有查驗義務的企業。

最新旅遊情報攻略

資料來源

生活分享