Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

因應歐盟AI法規!Anthropic揭曉Claude文字「隱形浮水印」底層運作機制

Дата публикации: 17-08-2026 00:00:20

為了符合歐盟《人工智慧法案》 (EU AI Act)針對AI生成內容的透明度規範,Anthropic近日正式公 […]

Основное содержимое страницы с новостью.

為了符合歐盟《人工智慧法案》 (EU AI Act)針對AI生成內容的透明度規範,Anthropic近日正式公開旗下Claude模型在生成文字時所採用的「浮水印」 (Watermarking)運作機制。與外界想像的隱藏代碼或視覺標記不同,Anthropic採用一套極度隱蔽的統計學演算法,讓浮水印與文字內容本身融為一體。

因應歐盟AI法規!Anthropic揭曉Claude文字「隱形浮水印」底層運作機制

這 是 廣 告 / This is Advertisement.

不加亂碼、不改字義,將浮水印藏在「機率」中

Anthropic強調,Claude的文字浮水印不會包含任何肉眼可見的記號,不會加入隱藏的字元,也不會改變文字的品質或增加推論的運算成本。相反地,這套機制是建立在大型語言模型生成文字的底層邏輯之上。

大型語言模型在生成句子時,是一次預測一個詞元 (Token),並且從候選名單中挑選出最符合上下文語境的詞彙。例如當前文是「今天的天氣很冷且…」時,接下來的字極不可能是「含糖的」,而很有可能是「陰暗的」 (overcast)或「灰濛濛的」 (grey),而在正常情況下,模型會透過隨機亂數來決定要用哪一個同義詞。

當浮水印機制啟動後,Claude將不再使用一般的隨機亂數,而是導入一把專屬的「密鑰」 (Key)與前文作為亂數來源。Anthropic舉例,若密鑰使用的是圓周率 (Pi)的數列,系統可能會依據特定的密鑰規律,藉此挑選候選名單中的特定順位詞彙。

這套改編自Google DeepMind「SynthID-Text」技術的機制,能夠在不影響語意與閱讀體驗的前提下,在成千上萬的單字選擇中留下特定的統計學規律。

浮水印的侷限:無法分辨是「原創」還是「潤稿」

儘管這套隱形浮水印具備高度隱蔽性,但Anthropic也坦承其在實際應用上仍存在不少侷限。

首先,這套機制只能偵測出Claude「是否參與了這段文字的處理」,但無法分辨AI究竟是從頭到尾原創,或是僅幫人類作者進行文法潤飾或翻譯。一旦使用者請Claude幫忙除錯或修改標點符號,整段文字也會被染上AI浮水印。

此外,如果生成的文字太短,或是屬於極度講究精確度的事實陳述,由於模型缺乏替換同義詞的彈性空間,浮水印的偵測效果將大打折扣。

這 是 廣 告 / This is Advertisement.

這項限制在「程式碼生成」上尤為明顯。Anthropic指出,因為程式碼具有嚴格的語法限制,沒有太多隨機選字的空間,因此程式碼中所能嵌入的浮水印強度,通常遠低於一般的散文或文章。

將推出檢測API,全面標記8月後的新模型

未來,Anthropic將對外釋出專屬的檢測API,讓擁有「密鑰」的第三方平台或研究機構能夠對特定文字區塊進行解碼,藉此判定該段文字是否由Claude所生成。此外,針對影像生成,Anthropic也會透過嵌入符合C2PA標準的加密簽章中繼資料 (Metadata)來標記AI圖片。

Anthropic表示,目前這項浮水印政策將預設適用於2026年8月2日之後釋出的所有Claude模型,未來幾個月內也將陸續回溯支援舊款模型,藉此全面迎合歐盟與全球各地日漸收緊的AI監管趨勢。

浮水印是「合規工具」,卻非絕對的「防偽證明」

從Anthropic的技術聲明中可以清楚看見,純文字的浮水印並非萬靈丹。這套基於機率與詞彙替換的SynthID-Text技術,只要經過人類的深度改寫、重新編排或透過其他未加浮水印的模型進行二次翻譯,其統計規律就很容易被破壞或稀釋。

我們應該將這類AI浮水印視為科技巨頭因應歐盟法規的「合規基礎設施」,而非判斷版權歸屬或學術造假的「絕對鐵證」。當AI成為日常生產力工具,人類與AI協同寫作將成為常態,糾結於一段文字究竟有百分之幾是AI寫的,在未來的實務應用上或許將變得越來越難以界定。科技巨頭所能做的,就是盡到演算法供應商的揭露義務,而如何正確解讀與利用這些「被標記的數位內容」,仍將是人類社會必須共同面對的全新課題。

這 是 廣 告 / This is Advertisement.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1How Anthropic plans to watermark Claude's AI-generated text012.0714-08-2026
2Невидимые метки ИИ: Anthropic будет маркировать всё, что пишет Claude08.3311-08-2026
3Sorry, students: Anthropic adding watermarks to AI-generated content, potentially making cheating harder013.1312-08-2026
4Anthropic внедрит «невидимый водяной знак» в тексты Claude AI08.116-08-2026
5超越OpenAI?Anthropic營收狂飆近14倍、突破115億美元,傳已秘密遞交IPO申請043.3317-08-2026
6Why Claude’s Watermarking Won’t Fix Anything024.1613-08-2026
7Blick ins Heft c’t 17/2026: KI-Fakes sicher erkennen019.0106-08-2026
8Claude Mythos 1 Leak Reveals Dangerous AI Security Shift-2725-05-2026
9Your Next Claude-Generated Drafts & Images Will Carry an Invisible Watermark: Here's Why011.2114-08-2026

Классификация: Пресс-релизы. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 26.67. Источник: mashdigi.com.