為了符合歐盟《人工智慧法案》 (EU AI Act)針對AI生成內容的透明度規範,Anthropic近日正式公 […]
為了符合歐盟《人工智慧法案》 (EU AI Act)針對AI生成內容的透明度規範,Anthropic近日正式公開旗下Claude模型在生成文字時所採用的「浮水印」 (Watermarking)運作機制。與外界想像的隱藏代碼或視覺標記不同,Anthropic採用一套極度隱蔽的統計學演算法,讓浮水印與文字內容本身融為一體。
這 是 廣 告 / This is Advertisement.
Anthropic強調,Claude的文字浮水印不會包含任何肉眼可見的記號,不會加入隱藏的字元,也不會改變文字的品質或增加推論的運算成本。相反地,這套機制是建立在大型語言模型生成文字的底層邏輯之上。
大型語言模型在生成句子時,是一次預測一個詞元 (Token),並且從候選名單中挑選出最符合上下文語境的詞彙。例如當前文是「今天的天氣很冷且…」時,接下來的字極不可能是「含糖的」,而很有可能是「陰暗的」 (overcast)或「灰濛濛的」 (grey),而在正常情況下,模型會透過隨機亂數來決定要用哪一個同義詞。
當浮水印機制啟動後,Claude將不再使用一般的隨機亂數,而是導入一把專屬的「密鑰」 (Key)與前文作為亂數來源。Anthropic舉例,若密鑰使用的是圓周率 (Pi)的數列,系統可能會依據特定的密鑰規律,藉此挑選候選名單中的特定順位詞彙。
這套改編自Google DeepMind「SynthID-Text」技術的機制,能夠在不影響語意與閱讀體驗的前提下,在成千上萬的單字選擇中留下特定的統計學規律。
浮水印的侷限:無法分辨是「原創」還是「潤稿」儘管這套隱形浮水印具備高度隱蔽性,但Anthropic也坦承其在實際應用上仍存在不少侷限。
首先,這套機制只能偵測出Claude「是否參與了這段文字的處理」,但無法分辨AI究竟是從頭到尾原創,或是僅幫人類作者進行文法潤飾或翻譯。一旦使用者請Claude幫忙除錯或修改標點符號,整段文字也會被染上AI浮水印。
此外,如果生成的文字太短,或是屬於極度講究精確度的事實陳述,由於模型缺乏替換同義詞的彈性空間,浮水印的偵測效果將大打折扣。
這 是 廣 告 / This is Advertisement.
這項限制在「程式碼生成」上尤為明顯。Anthropic指出,因為程式碼具有嚴格的語法限制,沒有太多隨機選字的空間,因此程式碼中所能嵌入的浮水印強度,通常遠低於一般的散文或文章。
將推出檢測API,全面標記8月後的新模型未來,Anthropic將對外釋出專屬的檢測API,讓擁有「密鑰」的第三方平台或研究機構能夠對特定文字區塊進行解碼,藉此判定該段文字是否由Claude所生成。此外,針對影像生成,Anthropic也會透過嵌入符合C2PA標準的加密簽章中繼資料 (Metadata)來標記AI圖片。
Anthropic表示,目前這項浮水印政策將預設適用於2026年8月2日之後釋出的所有Claude模型,未來幾個月內也將陸續回溯支援舊款模型,藉此全面迎合歐盟與全球各地日漸收緊的AI監管趨勢。
浮水印是「合規工具」,卻非絕對的「防偽證明」從Anthropic的技術聲明中可以清楚看見,純文字的浮水印並非萬靈丹。這套基於機率與詞彙替換的SynthID-Text技術,只要經過人類的深度改寫、重新編排或透過其他未加浮水印的模型進行二次翻譯,其統計規律就很容易被破壞或稀釋。
我們應該將這類AI浮水印視為科技巨頭因應歐盟法規的「合規基礎設施」,而非判斷版權歸屬或學術造假的「絕對鐵證」。當AI成為日常生產力工具,人類與AI協同寫作將成為常態,糾結於一段文字究竟有百分之幾是AI寫的,在未來的實務應用上或許將變得越來越難以界定。科技巨頭所能做的,就是盡到演算法供應商的揭露義務,而如何正確解讀與利用這些「被標記的數位內容」,仍將是人類社會必須共同面對的全新課題。
這 是 廣 告 / This is Advertisement.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | How Anthropic plans to watermark Claude's AI-generated text | 0 | 12.07 | 14-08-2026 |
| 2 | Невидимые метки ИИ: Anthropic будет маркировать всё, что пишет Claude | 0 | 8.33 | 11-08-2026 |
| 3 | Sorry, students: Anthropic adding watermarks to AI-generated content, potentially making cheating harder | 0 | 13.13 | 12-08-2026 |
| 4 | Anthropic внедрит «невидимый водяной знак» в тексты Claude AI | 0 | 8.1 | 16-08-2026 |
| 5 | 超越OpenAI?Anthropic營收狂飆近14倍、突破115億美元,傳已秘密遞交IPO申請 | 0 | 43.33 | 17-08-2026 |
| 6 | Why Claude’s Watermarking Won’t Fix Anything | 0 | 24.16 | 13-08-2026 |
| 7 | Blick ins Heft c’t 17/2026: KI-Fakes sicher erkennen | 0 | 19.01 | 06-08-2026 |
| 8 | Claude Mythos 1 Leak Reveals Dangerous AI Security Shift | -2 | 7 | 25-05-2026 |
| 9 | Your Next Claude-Generated Drafts & Images Will Carry an Invisible Watermark: Here's Why | 0 | 11.21 | 14-08-2026 |