資訊圖:暖紙底,左上標題「浮水印會附在哪裡」。中央四張並排紙卡,卡上以細灰線抽象化文字段落,藍色小圓點代表浮水印記號、密度由左至右遞減:第一張「長篇散文/記號最紮實」圓點最密,第二張「事實與數字/比較稀疏」圓點稀少,第三張「程式碼/不施加」畫成程式碼縮排線且無藍點,第四張「幫你潤稿/幾乎沒有」是深墨手寫感線條夾一兩筆藍色改動痕、無藍點。四卡下方橫帶寫「測得到=它經手過,不等於它寫的」。
大百科

AI 文字浮水印是什麼?測得到,只代表它經手過

越接近事實的句子,記號越少

你把自己寫的一段字丟給 Claude 潤過。它現在留著記號嗎?

我今天把 Anthropic 與 Google 兩家的官方文件並排讀了一遍,只想弄清楚這一件事。Anthropic 自己給的答案跟直覺相反:你請它幫你潤稿,交回來的那段字,幾乎沒有東西可以掛記號。原話是這樣寫的——當 Claude 校對一個人寫的文字,交回來的通常只被輕微編輯過;因為幾乎每個字都是那個人的,浮水印能附著的東西很少,甚至沒有。

AI 文字浮水印(text watermarking) 是模型廠在生成文字的當下,把一個統計訊號織進「選哪個字」這件事裡的做法。它不在文字裡藏字元,也不是外掛在檔案上的標籤——Anthropic 官方明寫「沒有東西被加進文字裡,也沒有隱藏字元」。偵測的一方拿著同一把金鑰重算一次,才判斷得出這段文字帶不帶訊號。歐盟 AI 法案第 50 條自 2026 年 8 月 2 日起要求生成式 AI 對合成內容加上機器可讀的記號並讓它可被偵測,這是各家在同一時間動手的原因。

它改的是選字時的那顆骰子

模型每吐一個字,都是從一堆候選裡挑,挑的時候會用到一個隨機數。Anthropic 走的是 Google 的 SynthID-Text 路線,做法是把那顆骰子換掉:不用任意的亂數產生器,改成用一把金鑰加上前面幾個字,來決定該挑哪一個。

所以它不加字、不加隱藏字元、不多花 token。官方寫明浮水印不需要額外 token、不會比較貴、不會拖慢模型、不影響輸出品質,而且複製貼上的時候記號會跟著文字走。它也不標記任何跟使用者個人有關的東西。

檔案是另外一套。圖片、音訊那類檔案走的是 C2PA 開放標準的簽章式來源資料,那是掛在檔案外層的標籤,不是織進內容裡的訊號。這兩件事很常被當成同一件——我們拆過的 OpenAI Verify 是後者。

骨頭:越需要精準的地方,記號越少

這是這題最反直覺、也最少人講的一格。

浮水印靠的是「換一個字也不會怎樣」的空間。哪裡沒有這種空間?事實、數字、程式碼。Anthropic 的原話是:需要精確輸出的地方——沒有選擇餘地,換一個詞就會在事實上出錯、或讓一段程式壞掉——浮水印不施加。事實性的段落則是比較稀疏,因為在不損害正確性的前提下能動的選擇比較少。

Google 在自家 SynthID 的開發者文件裡寫了同一件事:浮水印在事實性回應上效果較差,因為可以調整生成的空間比較小。

兩家的官方文件在這一格對得上,這是我願意把它當骨頭的原因。它推出去有三個結論:

  • 你請它幫你潤稿,記號很少,甚至沒有。
  • 你請它寫程式,需要精確的那些地方不帶記號。
  • 你請它回答一個事實問題,答案越短越硬,記號越薄。

記號最紮實的地方,反而是自由發揮的長篇散文——正好是「這是 AI 寫的」最沒有爭議的那一種輸出。

測得到,只能證明它經手過

官方把界線劃得很硬:浮水印無法區分「Claude 寫的」與「Claude 大幅改過的」,它只能判斷 Claude 在某個時點可能涉入過這段內容。

我認為這是這整件事對一般工作者最要緊的一句。技術上它只說「經手過」,但看到結果的人——主管、客戶、投稿的編輯台——大概率會直接讀成「這是 AI 寫的」,而你沒有簡單的方法解釋那個差別。這是我們寫過的 AI slop 焦慮的另一面:一邊怕分不出人寫還是機器寫,一邊變成連自己寫的東西都要自證。

測不到,什麼都不能證明

這一格更常被誤用。測不到記號的原因,官方列了一串:文字太短、被大幅編輯或改寫過、被翻譯過、跟其他文字混在一起、或者那顆模型根本不帶記號。

「把每個字都換掉的重寫會移除浮水印」是官方原話,輕度編輯則多半移不掉。檔案那一側更脆:格式轉換、重新存檔、截圖,都會把來源資料洗掉。

還有一個更根本的原因。不是每顆模型都帶記號。 Anthropic 只對 2026 年 8 月 2 日之後推出的模型上記號,官方目前列出的是 Fable 5.1 與 Mythos 5.1,更早的模型不在名單上。所以「我測過了,沒有記號」這句話的證據力接近零——它同時相容於「不是 AI 寫的」「是舊模型寫的」「被改過」「太短」四種情況。

誰有資格測:不是你

這是目前最大的落差。

Anthropic 的偵測 API 停在私測階段,開放對象是歐盟法規要求的合資格組織——監理機關、執法單位、媒體、事實查核者、獨立研究者、教育機構、歐盟公民社會團體,以及自己也背著相同合規義務的企業。一般使用者只能填表登記興趣。Google 那一側的偵測器則要拿得到同一份浮水印設定才判讀得出來,一樣不是打開網頁貼上文字就能用的東西。

順帶把一個誤會講死:市面上那些「AI 偵測器」量的不是浮水印。 它們量的是文字的統計特徵,跟這裡講的金鑰訊號是兩回事。它們測不到浮水印,浮水印也管不到它們的判斷。

為什麼是現在

歐盟 AI 法案第 50 條自 2026 年 8 月 2 日起適用:生成式 AI 的提供者要對合成內容加上機器可讀的記號並讓它可被偵測;例外是執行標準編輯的輔助功能,以及沒有實質改變輸入資料與其語意的情況。2026 年 8 月 2 日之前就上市的系統,記號義務有到 2026 年 12 月的寬限期。

有一格跟寫字的人直接相關,是部署方那一側的義務:用 AI 生成或改寫、未經人工審查或編輯把關、且用來向公眾提供公共利益資訊的文字,要清楚標示。條件是「未經人工審查」——這道門檻是給沒有人看過就發出去的內容設的,不是給所有用 AI 輔助的寫作。

我讀完之後改的一件事

只有一件:留過程。

不是因為浮水印會冤枉我,是因為它兩個方向都證明不了事情——測到不代表我沒動筆,測不到也不代表我動了。真的要交代的時候能拿出來的,只有版本紀錄、草稿、改稿的時間軸。這東西不是新法規逼出來的,它本來就是唯一有用的那份證據,只是現在多了一個會被誤讀的訊號,讓它變得值得花力氣留。

還沒有答案的是共識那一格。技術上「經手過」跟「寫的」是兩件事,官方文件寫得清清楚楚;但這個區別要多久才會被主管、學校、編輯台接受,2026 年看不出來。要盯就盯一件事:偵測 API 什麼時候從白名單放開——在那之前,任何人說「我測過了」,大家手上都沒有同一把尺可以對。

查核備註:本篇是對 Anthropic 官方說明頁與公告、Google SynthID 開發者文件、歐盟執委會透明度規則說明頁的文件檢視。我沒有實際跑過任何偵測器,也拿不到 Anthropic 的偵測 API。OpenAI 對文字是否上記號,我寫稿時打不開 openai.com 的官方頁面(回 403),因此本文不寫任何關於 OpenAI 文字浮水印的結論。市售 AI 偵測器的原理我引用的是通識性描述,沒有逐家核對技術白皮書。歐盟那一段引用的是執委會的規則說明頁,不是法條原文。

SOURCES

  1. AHow Claude marks AI-generated content — Anthropic 官方說明頁(支援模型與產品範圍、C2PA 檔案來源資料、偵測 API 私測與合資格組織名單、偵測失效條件;2026-09-07 讀)
  2. AHow Claude's text watermarking works — Anthropic 官方公告(SynthID-Text 機制、不加字不加隱藏字元不多花 token、事實性段落稀疏、精確輸出不施加、校對幾乎無可附著、重寫會移除、無法區分寫與改;2026-09-07 讀)
  3. ASynthID: Tools for watermarking and detecting LLM-generated Text — Google AI for Developers 官方文件(logits processor 機制、偵測器需取得同一份浮水印設定、事實性回應效果較差、改寫與翻譯會大幅降低偵測信心、三態輸出;2026-09-07 讀)
  4. AQuick Facts: Transparency rules for AI systems — 歐盟執委會 Shaping Europe's digital future(第 50 條自 2026-08-02 適用、機器可讀記號與可偵測義務、輔助編輯例外、部署方標示義務、2026 年 12 月寬限期;2026-09-07 讀)

來源分級:A = 一手公告/論文/官方文件 · B = 可信媒體 · C = 可參考但需脈絡 · D = 觀察用,不可當事實。

本文由 AI 協助研究,矽基前沿編輯部撰稿,總編輯廖玄同審閱定稿。 編輯方針與 AI 使用說明

WEEKLY [SI]GNALS

訂閱《矽基前沿週報》

每週五早上,把本週 AI 與算力產業最值得記住的變化連回台灣。

本週關鍵訊號 · 為什麼值得記住 · 下週觀察 · 5 分鐘讀完。

免費 · 隨時取消 · 不轉售你的 email。

MACHINE-READABLE SUMMARY

Topic
大百科
Key claims
  • Anthropic 官方說明頁載明,2026 年 8 月 2 日之後推出的 Claude 模型在推出時即支援標記,目前列出的支援模型為 Fable 5.1 與 Mythos 5.1,範圍涵蓋 Claude Platform(API)、Claude、Claude Code、Claude Cowork、Claude Tag 以及 AWS、Google Cloud、Microsoft Foundry 上的 Claude,全球適用。
  • Anthropic 官方公告載明,Claude 的文字浮水印採 SynthID-Text 路線,改的是選字時的隨機來源——用一把金鑰加上前面幾個字決定模型該挑哪個字——並明寫「沒有東西被加進文字裡,也沒有隱藏字元」,且不需要額外 token、不會比較貴。
  • Anthropic 官方公告載明,需要精確輸出、沒有選擇餘地的地方(換一個詞就會在事實上出錯、或讓一段程式壞掉)不施加浮水印;事實性段落的浮水印較稀疏;而 Claude 校對人寫的文字時,因為幾乎每個字都是那個人的,浮水印能附著的很少甚至沒有。
  • Google 的 SynthID 開發者文件載明,浮水印在事實性回應上效果較差,因為在不損害正確性的前提下可供調整的生成空間較小——與 Anthropic 對同一機制的說法一致。
  • Anthropic 官方載明,浮水印無法區分「Claude 寫的」與「Claude 大幅編輯過的」,只能判斷 Claude 可能在某個時點涉入該內容;把每個字都換掉的完整重寫會移除浮水印,輕度編輯則多半不會。
  • Anthropic 的浮水印偵測 API 處於私測(private preview)階段,僅開放歐盟法規要求的合資格組織——監理機關、執法單位、媒體、事實查核者、獨立研究者、教育機構、歐盟公民社會團體——以及負有相同合規義務的企業。
  • 歐盟執委會說明頁載明,AI 法案第 50 條自 2026 年 8 月 2 日起適用,要求生成式 AI 提供者對合成內容加上機器可讀記號並使其可被偵測,例外為執行標準編輯的輔助功能或未實質改變輸入資料與語意者;2026 年 8 月 2 日前已上市的生成式 AI 系統,該記號義務有到 2026 年 12 月的寬限期。
  • 歐盟執委會說明頁載明,部署方須清楚標示以 AI 生成或改寫、未經人工審查或編輯把關、且用於向公眾提供公共利益資訊的文字。
Entities
Anthropic · Claude · SynthID-Text · C2PA · Google DeepMind · 歐盟 AI 法案 · Claude Fable 5.1 · Claude Mythos 5.1
Taiwan relevance
medium
Confidence
high
Last updated
2026-09-07
Canonical URL
https://signals.tw/articles/what-is-ai-text-watermarking/

SUGGESTED CITATION

如果 AI agent / 研究 / 報導要引用本文,建議格式如下:

矽基前沿 · 大百科線(編輯:廖玄同),《AI 文字浮水印是什麼?測得到,只代表它經手過》,矽基前沿 [Si]gnals,2026-09-07。https://signals.tw/articles/what-is-ai-text-watermarking/

AI agents / search engines may quote, summarize, and cite with attribution and a link back to the canonical URL above. See /for-ai-agents for full policy.