💡 核心結論速覽 (TL;DR)
- 掃隱形字元掃不到,是設計本來就這樣:官方 8 月 14 日原文寫得很白——文字裡沒有加任何東西進去,也沒有隱藏字元。它動的是模型「挑下一個字」時的亂數來源。
- 翻譯稿全中,潤稿幾乎不留痕:官方明說翻譯每個字都是 Claude 選的、會完整帶浮水印;只修文法標點的潤稿,能附著的地方少到可能驗不出來。
- 關不掉,而且不只 Claude 一家:涵蓋 API、Claude Code、Cowork、Claude Tag 且全球適用;歐盟那份透明度行為準則約 190 家簽了,Google、Meta、微軟、OpenAI 都在名單上。
- 現在該做的只有一件事:官方偵測 API 只寫「即將提供」、沒有日期,所以先照使用方式把自己的稿子分三類看風險就好,別花錢買任何宣稱能移除浮水印的工具——沒有偵測器,沒人驗得出它有沒有效。
朋友前幾天傳訊息問我:「我用 Claude 幫我把英文報告翻成中文,這樣算不算 AI 寫的?會被驗出來嗎?」
先給直接的答案:Claude 浮水印確實已經上路,關不掉,但它跟你以為的那件事不一樣——它不是在文字裡塞看不見的符號,所以你用任何「隱形字元偵測器」去掃都是零命中。而你朋友那個翻譯稿,恰恰是最容易被驗出來的那一種。
我每天泡在 AI 工具裡超過十小時,多半在跑自動化、寫程式、整理資料,所以八月初 Anthropic 宣布要嵌浮水印的時候,我第一件事就是把手上的檔案通通拆開來掃。當時掃出來的結果是乾淨的,我也照著那個結果寫過一篇。結果 8 月 14 日官方補了一篇技術說明上來——我原本靠掃描反推的那套判斷,方向是對的,但依據要整個換掉。
這篇就是把那份官方說明拆給你看:它到底怎麼運作、哪種用法會留下痕跡、哪種幾乎不會,以及被驗出「有標記」到底能證明什麼。
Claude 浮水印是什麼?官方把「為什麼掃不到」寫清楚了
Claude 浮水印不是插入隱形字元,而是改變模型挑選下一個字時的亂數來源。Anthropic 在 2026 年 8 月 14 日發布的官方說明裡直接寫了一句話:文字裡沒有加任何東西進去,也沒有隱藏字元。說真的,我看到這句的時候有點想笑——它一口氣解釋了為什麼中文圈那些「教你三秒鐘掃出 AI 痕跡」的教學全都是白工。
官方自己用了一個我覺得很好懂的比喻。想像你在玩大富翁,每一輪靠擲骰子決定走幾步。現在把骰子換掉,改成翻一本圓周率位數表,從中間隨便一個位數開始,每個人輪流拿下一位當作點數。對玩家來說完全沒差,走的步數一樣是隨機的;但如果事後有人看到整局的移動序列、又剛好知道圓周率,他就能推算出這局「很可能是用圓周率跑出來的」。
Claude 挑字就是這樣。Anthropic 舉的例子是「今天天氣又冷又⋯⋯」,下一個字幾乎不可能是「甜」,但「陰」或「灰」都說得通。這種兩邊都對、選哪個讀者都無感的位置,一篇文章裡會出現非常多次。浮水印做的事,就是把「到底挑哪一個」的決定權,從一般的亂數產生器換成「一把金鑰+前面幾個字」共同決定。字還是隨機挑的,但握有金鑰的人可以回頭核對整串選字,算出「這段話有多大機率是 Claude 產的」。
官方也特別澄清了一個容易誤解的地方:它不會讓模型從此偏愛「陰」這個字,也不會逼 Claude 去挑一個它本來根本不會用的冷僻字。
所以這一段可以濃縮成兩句話:
- 浮水印不是「多出來的東西」,而是「挑字的方式」——所以任何掃隱形字元、掃特殊符號的工具,對它永遠是零命中。
- 它需要金鑰才驗得出來,沒有金鑰的人(包含搜尋引擎、你的客戶、你的老師)目前一律讀不到。
這個技術不是 Anthropic 自己發明的。官方寫明它是 Google DeepMind 的 SynthID-Text 方法的一個版本,原始論文 2024 年發表在《自然》期刊,整個思路更早可以追到 Scott Aaronson 在 2022 年提出的構想。
把三種常被混為一談的東西攤開來看,會清楚很多:
| 類型 | 怎麼運作 | 誰驗得出來 |
|---|---|---|
| Claude 文字浮水印 | 模型挑字時換掉亂數來源,不增減任何字元 | 只有握有金鑰的一方;官方偵測 API 尚未開放 |
| C2PA 內容憑證 | 在 .png/.jpg/.svg 的中繼資料裡附一段簽章,檔案本身不變 | 任何支援 C2PA 的工具都讀得到 |
| AI 偵測軟體(如 Pangram) | 看文字癖性去猜,沒有金鑰 | 誰都能跑,但會誤判 |
第三欄那個「會誤判」不是我加的形容詞。官方在同一篇裡點名了 Pangram 這類偵測軟體,說它們的原理是抓 AI 的用字癖好——例如 AI 特別愛用「這不是 X,而是 Y」這種句型,也比一般人更常用到「悄悄地」。我看到這段忍不住笑出來,因為這剛好跟我之前拆維基百科那份 AI 寫作特徵清單的結論對上了:那份清單裡有 6 個判準其實會冤枉人,而現在連模型廠自己都出面說「靠句型猜」跟「查浮水印」是兩回事。
如果你是被這種偵測軟體判過的當事人——作業被退、稿子被質疑——那要處理的是另一套流程,我另外整理過被誤判時的自證清白 5 步,這篇就不重複了。
Claude 浮水印關得掉嗎?API、Claude Code、Cowork 全都有,雲端有一格例外
關不掉。Anthropic 官方說明中心那頁從頭到尾沒有提供任何關閉選項,而且標記是做在模型層——不管文字從哪個產品跑出來,它都在。
涵蓋範圍寫得很明確,這是很多中文報導帶過去、但對實際在用工具的人最要緊的一段。文字浮水印在下面每一條管道都會套用,沒有任何一條是例外:
- Claude 網頁版與 App
- Claude Platform(API)
- Claude Code
- Claude Cowork
- Claude Tag
- 透過 AWS、Google Cloud、Microsoft Foundry 取用支援的模型時,一樣照套
真正有差別的是檔案那一側。官方寫的是:簽章式來源資訊不一定每個雲端平台都支援,要看各平台提供什麼功能——這是企業導入前最該先問清楚的一格。說明頁另外還有一句更廣的但書——某些平台或功能可能不支援特定的標記類型。
所以如果你的公司是走雲端市集串 Claude,「檔案有沒有帶簽章」這件事不能假設,得實際拿一個產出的檔案去驗。這種事我在帶產品的時候看多了:合規文件寫「支援」,實際落到某個部署組合上就變成「這個功能還沒開」,最後爆掉的都是沒人去實測那一格的地方。
另外一個常被問的是舊模型。官方說法是:歐盟法規給了 2026 年 8 月 2 日之前推出的模型一段過渡期,Anthropic 正在替那些舊模型補上浮水印支援,會在接下來幾個月陸續推出。換句話說,你現在拿舊模型跑出來的東西可能還沒有標記,但這是時間問題不是永久豁免——把它當成「還沒輪到」比較安全。
如果你平常主要在用 Cowork 處理 Excel、Word、PDF,或是把 Claude Tag 掛在 Slack 當同事,這兩條線的產出一樣在涵蓋範圍內,不會因為「我沒開網頁版」就沒事。
哪種稿子最容易被驗出來?Claude 浮水印在翻譯稿最濃、潤稿幾乎不留痕
浮水印的濃度取決於「有多少個字是 Claude 自己選的」。翻譯是密度最高的一種,因為官方明說:Claude 產出的翻譯會帶浮水印,這種情況下每一個字都是它挑的。相對地,你自己寫完、只請它改文法標點的潤稿,浮水印只能附著在那寥寥幾處修改上,可能少到根本驗不出來。
這條判準我覺得是整件事裡最反直覺、也最少人講的一段。多數人的直覺是「我只是拿去翻譯而已,又不是叫它寫」,但從浮水印的角度看,翻譯是 100% 由模型逐字生成的內容;反而是「AI 深度參與但我逐句改寫過」的稿子,痕跡會淡很多。
| 你怎麼用 Claude | 浮水印密度 | 對你的意義 |
|---|---|---|
| 整段請它翻譯 | 最高(每個字都是它挑的) | 最容易被驗出「Claude 參與過」 |
| 請它從零起草長文 | 高,且愈長愈明顯 | 官方說文字愈長,判斷信心愈高 |
| 事實密集的段落 | 稀疏 | 正確答案只有一個時,浮水印無處著力 |
| 只改文法與標點的潤稿 | 極低 | 官方說可能不足以被偵測到 |
| 很短的一兩句 | 低到不可靠 | 樣本太小,選字次數不夠 |
「事實密集段落浮水印稀疏」這條,官方舉的例子很傳神:「牛頓最有名的著作叫《Principia⋯⋯》」,下一個字只有「Mathematica」是對的,模型根本沒有選擇空間,浮水印當然無從落腳。
我把這條套回自己的工作習慣看,結論是該擔心的順序跟大家想的相反。我平常會刻意把翻譯、資料整理、程式這幾件事分開丟給不同工具處理,原本純粹是為了品質——商務信、論文、口譯三種場景我實測下來各有各的最佳解,本來就不會全部丟同一家。現在看官方這份說明,這個習慣意外多了一層意義:整段翻譯的產物,浮水印密度是所有用法裡最高的。
那這對誰真的有影響?我會這樣分:
❶ 接案寫手、投稿比賽、學術作業——如果對方明訂「不得使用 AI 生成」,而你把整段丟去翻譯或起草,這是實質風險,不是心理作用。
❷ 企業文件與對外稿——影響的不是合不合規,是「你有沒有先跟客戶說清楚流程」。標記本身不會通知任何人,但你被問到時得答得出來。
❸ 個人筆記、內部草稿、自己要再改寫的東西——實務上沒有影響,因為沒有人會拿去驗,而且你改寫之後密度也會掉。
Claude Code 產出的程式碼有浮水印嗎?官方說「基本上沒有」,但註解那格有
Claude Code 產出的程式碼本體基本上不帶浮水印。原因跟前一段同一套邏輯:浮水印只能長在「兩個選擇一樣好」的位置,而程式碼在絕大多數地方必須精確——換一個變數名或函式名就會壞掉,那裡就沒有可以下手的空間。
官方講得更直白:一旦模型寫出「2 + 2 =」,下一個 token 的最佳解就只有一個,浮水印那個「輕推」不會被套用。所以程式碼整體帶的浮水印會比其他文字少很多,對實際產出的程式碼影響可以忽略。
有例外,而且這個例外滿有趣的:註解。註解怎麼寫是有語意自由度的,同一件事可以用好幾種說法表達,所以浮水印可以落在那裡。官方也補了一句——即便如此,它對真正的程式碼本身仍然影響微乎其微。
對每天用 Claude Code 跑自動化的人來說,這段可以翻譯成三個實務結論:
❶ 交付給客戶的程式碼本身不用擔心「被驗出 AI 產的」,能被驗到的只有註解,而註解通常也不是驗收標的。
❷ 但你寫給客戶的技術文件、README、PR 說明會帶——那些是自然語言,浮水印密度跟一般文章一樣。企業導入前該講清楚的是這一塊,不是程式碼。
❸ 不會多花你一毛錢。官方明說浮水印不會產生額外 token,所以模型的服務與使用價格完全不變,對速度的影響也可以忽略。這點對用 API 按量計費的人特別重要——如果你最近在盯 Claude 的帳單,真正讓帳單變動的是斷詞器換代那件事,不是浮水印,兩件事別搞混。
順帶一提,如果你是把 Claude Code 當日常主力的人,額度與費用那條線的變化比浮水印有感多了,像 8/17 起預設開啟的額度重置自動接續就是會直接影響你怎麼排工作的設定。
驗出 Claude 浮水印代表什麼?三件它證明不了的事
驗到 Claude 標記,只能推論「Claude 很可能在某個環節參與過這段內容」,僅此而已。官方在兩份文件裡都把這條限制寫得很重,我覺得這才是接案者、學生、部落客真正該記住的一句。
具體來說,它證明不了這三件事:
❶ 證明不了「這是 AI 寫的、不是你寫的」。官方原文說得很清楚:浮水印無法分辨「Claude 寫了這個」和「Claude 大幅編輯了這個」。你自己構思、自己下判斷、只是請它幫忙潤飾或翻譯的原創內容,一樣可能被驗出標記。
❷ 證明不了「這是誰做的」。浮水印裡不含任何身分資訊,它的金鑰也不會讓任何人反推出使用者、組織或對話內容。它標的是「Claude 這個模型」,不是「你這個人」。這點跟很多人擔心的「會不會被追蹤」剛好相反——如果你在意的是自己跟 AI 的對話會不會被留存或拿去訓練,那要處理的是各家的隱私與訓練開關,跟浮水印是兩件事。
❸ 證明不了著作權歸屬或法律責任。官方明說浮水印不改變產出的所有權,也不改變使用者在服務條款下的權利。
反過來也一樣要小心:驗不到,不代表不是 AI 產的。官方說明頁列了五種驗不出來的情況——模型太舊還沒支援、文字被大改或翻譯過再混編、段落太短、中繼資料在轉檔或截圖時掉了、某個平台功能不支援該種標記。
所以拿浮水印當「抓 AI 內容」的鐵證,兩個方向都不成立。這是我覺得整件事最該被講出來、卻最常被新聞標題壓掉的一段:它是一個機率訊號,不是一張判決書。
Claude 浮水印移除工具有效嗎?偵測 API 沒開放,沒人驗得出來
目前沒有任何公開的方式可以驗證 Claude 浮水印,包含那些宣稱能移除它的工具。官方在 8 月 14 日那篇裡寫的是「即將提供浮水印偵測 API,實作細節仍在確認中」——沒有給日期。說明中心那頁對應的措辭是「將在後續的技術文件中說明」。
這件事有個很荒謬但很重要的推論:既然偵測器還沒開放,任何人都無法證明一段文字裡的標記真的被清乾淨了。
八月中的時候,GitHub 上一個宣稱能移除 Claude 標記的專案三天內衝到將近九千顆星(依動區 2026 年 8 月 15 日的報導,當時是 8,983 星)。但沒有偵測器,作者說有效跟 Anthropic 說沒被清掉,兩邊講的都只是自己吹。BleepingComputer 的觀察更直接:這類工具正在湧入網路,而幾乎沒有一個能證明自己真的有用。
在偵測器公開之前,整件事卡在一個死結:
- 工具作者無法證明自己真的清乾淨了。
- Anthropic 也無法當場證明標記還在。
- 而付錢的是你,兩邊的說法你都驗不了。
我不打算連結那個專案,也不會教你怎麼移除,理由跟我之前寫圖片標示那篇一樣:在檔案標示那邊我也是同一個立場——不是怕什麼,是成本效益完全不划算。你花時間去清一個目前沒有任何規則在罰、也沒有任何人驗得出來的東西,換到的是什麼?
倒是官方自己有講一段關於編輯的實話,可以當作判斷依據:輕度編輯多半不會把浮水印完全清掉,但把每一個字都換掉的完全重寫會。而官方接著補的那句才是重點——真到了那個地步,這段文字還能不能叫做「AI 生成」,本身就有得討論了。
檔案那邊倒是有好消息:官方說會提供自家的檢查工具,讓你把檔案拖進去就能查有沒有 C2PA 內容憑證。那個標籤跟文字浮水印是完全不同的東西——它不藏在內容裡,就是中繼資料裡一段加密簽章的註記,任何支援 C2PA 的工具都讀得到,相機廠商和修圖軟體早就在用同一套標準。
Claude 浮水印上路後我要改做法嗎?我會做的 3 件事和一條紅線
結論是內容生產流程不用改,但有兩件事值得你現在花五分鐘確認。先看你屬於哪一種狀況:
- 自己構思、AI 只做潤飾:不用調整,密度極低,繼續照原本方式做。
- 常整段丟去翻譯再交出去:要調整的是揭露而不是流程,先確認對方有沒有禁用 AI 的條款。
- 用 Claude Code 交付程式碼:程式碼本身不用管,但 README 與技術文件屬自然語言,密度跟一般文章一樣。
- 企業走雲端市集串 API:實測一次,拿一個實際產出的檔案去驗有沒有帶簽章。
- 學生、投稿比賽、接案:先讀清楚對方的 AI 使用規範,那份規範比浮水印本身重要得多。
我自己會做的三件事:
❶ 把「哪些內容是整段生成的」在心裡分一次類。不是為了規避,是因為一旦有人問起,你要答得出來。翻譯稿、從零起草的長文屬於高密度,自己寫完再修的屬於低密度——這個分類五分鐘就做得完。
❷ 把判斷寫進內容裡。這是老話了但這次更成立:浮水印能證明的只有「模型參與過」,它證明不了你的取捨、你踩過的雷、你為什麼不推薦某個選項。這些東西沒有任何模型生得出來,也是搜尋引擎真正在找的東西。
❸ 把複查排進行事曆。偵測 API 一旦開放,這篇的好幾個結論——尤其是「目前沒人驗得出來」——都要重新驗一次。我自己抓十月底回頭看。
一條紅線:不要為了保險去買任何宣稱能移除或檢測 Claude 浮水印的付費工具。在官方偵測 API 開放之前,市面上沒有任何一家能證明自己的準確率,這種 SaaS 訂閱付下去,你買到的是心安不是功能。
至於這件事對排名跟廣告收入的影響——那是另一個題目,我把 Google 生成式 AI 內容指引和 AdSense 發佈商政策的原文逐條比對過,結論放在講浮水印與 SEO、AdSense 那篇,這裡就不重複了。
還有一件很多人沒注意到的事:這不是 Claude 一家的事。依歐盟執委會 2026 年 7 月 31 日的公告,那份透明度行為準則到七月底約有 190 個組織簽署,marking 義務在 8 月 2 日生效,第一類簽署者的名單裡除了 Anthropic,還有 Google、Meta、Microsoft、Mistral 和 OpenAI。所以「換一家 AI 就沒事」這個想法,時間上大概只能撐幾個月。
這套判斷適合誰?什麼情況我不會這樣建議
適合的是把 AI 當工具、自己還是會下判斷把關的人——不管你是靠內容吃飯、還是每天用它處理工作。不適合的是「規則已經明訂不得使用 AI、你卻想用技術手段繞過去」的情境;那不是浮水印的問題,是誠信的問題,而且以現在的發展速度,繞過去的成本只會愈來愈高。
另外有一種人我的建議會反過來:如果你做的是新聞、醫療、法律這類讀者會拿去做重大決定的內容,那揭露的價值跟「規則有沒有要求」無關——讀者有權知道判斷是怎麼來的。但比起貼一句制式的「本文使用 AI 輔助」,對讀者更有用的是把查證流程攤開:每個數字出自哪份官方文件、哪一天查的、哪些是實際驗過的。那比一句籠統聲明具體十倍。
如果你想順便把手上的工具鏈盤一次,我把自己每天在用的 AI 工具依需求分類整理過一份,可以當起點;而如果你正在猶豫要不要為了某個功能升級 AI 訂閱方案,Claude 四檔方案我算過一輪,浮水印這件事不會是你該考慮的變數之一。至於把不同模型分工的做法,我拆過一套起稿、修文、補資料各自交給誰的流程,那套邏輯到現在還是成立的。
FAQ 常見問題
我請 Claude 潤稿和整段請它翻譯,哪個比較容易被驗出來?該怎麼選?
翻譯明顯高得多。官方說翻譯的每一個字都是 Claude 挑的,所以會帶完整浮水印;而只改文法標點的潤稿,能附著的地方少到可能驗不出來。如果你的交付對象明訂不得使用 AI 生成,那「自己寫完再請它修」是風險低很多的做法。但要提醒的是:這是密度差異不是保證,官方用的措辭是「可能不足以被偵測到」,不是「一定驗不到」。
被驗出有 Claude 標記,會不會影響我的著作權或案子驗收?
就官方文件而言不會。Anthropic 明說浮水印不改變產出的所有權,也不改變使用者在服務條款下的權利,它只能推論「Claude 可能參與過」。真正會影響驗收的是你跟客戶之間的約定——對方若有禁用 AI 的條款,問題出在條款而不在標記。所以與其擔心被驗出來,不如在報價階段就把使用方式講清楚。
網路上那些浮水印移除工具,我要不要買一個來保險?
不要。官方偵測 API 至今只寫「即將提供」、沒有給日期,在它開放之前,沒有任何第三方能證明自己的移除或檢測真的有效——這不是我的推測,是媒體實際追過那個爆紅的 GitHub 專案後得到的結論。付費買一個誰都驗不了的功能,買到的是心安不是效果。真的在意的話,把時間拿去確認對方的規範還比較實際。
那我改用別家 AI,是不是就不會有浮水印?
短期內可能有差,中長期大概不會。歐盟那份透明度行為準則到 2026 年 7 月底約有 190 個組織簽署,Google、Meta、Microsoft、Mistral、OpenAI 都在第一類簽署者名單上,marking 義務也已在 8 月 2 日生效。各家的實作時程不同,所以現在確實可能出現「這家有、那家還沒」的空窗,但把換工具當成長期解方,方向是錯的。
寫在最後:它是一個機率訊號,不是一張判決書
我對這件事的態度,從八月初掃檔案到現在看完官方技術說明,其實沒有變過——真正決定你的內容值不值錢的變數,一個都沒有因為浮水印而改變。變的只是「哪些說法現在有依據了」。
如果要我只留一句給你帶走,我會選這句:驗到標記不代表這不是你的作品,驗不到也不代表這不是 AI 產的。兩個方向都不成立的東西,本來就撐不起「抓包」這兩個字。
倒是有件事我覺得比浮水印重要得多——這件事還在動。偵測 API 沒有日期、舊模型的過渡期還在補、各家實作進度也不一樣。我自己的習慣是把這種「還沒定案」的題目排進複查清單,等官方技術文件出來再回頭驗一次結論,而不是寫完就當定論。想看看我平常怎麼判斷這類消息值不值得動手,可以逛逛我的其他實驗紀錄;訂閱我的部落格,會不定期收到信。
參考資料
- How Claude's text watermarking works — Anthropic 官方公告(2026/8/14)——本篇原理、翻譯/潤稿/程式碼密度差異、偵測 API 進度的主要出處
- How Claude marks AI-generated content — Anthropic 官方說明中心——涵蓋範圍、雲端平台差異、驗不到的五種情況
- Strong backing for the Code of Practice on Transparency of AI-generated Content — European Commission(2026/7/31)——約 190 家簽署與簽署者名單
- Scalable watermarking for identifying large language model outputs — Nature(2024)——SynthID-Text 原始論文
- SynthID — Google DeepMind
- Coalition for Content Provenance and Authenticity (C2PA) 官方網站
- Claude 剛埋浮水印!移除工具三天衝上 9,000 星,沒人能驗證效果 — 動區(2026/8/15)——星數為該報導查詢當時的數值