Для подписчиковСегодня разберемся, как языковые модели прячут информацию в обычном тексте — без простых трюков вроде невидимых символов. Рассмотрим водяные знаки Claude и на практике проверим инструмент, превращающий секретное сообщение в безобидную переписку.
Лучшие статьи квартала на бумаге
2 000 ₽
Заказать журналПолный доступ к статьям и архиву выпусков
6 000 ₽ в год
ПодписатьсяСовместный курс «Хакера» и лаборатории «Хаксет»
7 000 ₽
Купить курсЛучшие статьи за 2021–2022 годы на бумаге
2 000 ₽
Заказать журналСегодня разберемся, как языковые модели прячут информацию в обычном тексте — без простых трюков вроде невидимых символов. Рассмотрим водяные знаки Claude и на практике проверим инструмент, превращающий секретное сообщение в безобидную переписку.
Вотермарки в LLMВ середине августа 2026 года в Anthropic анонсировали появление водяных знаков в текстах, которые создают модели Claude. Технологию внедряют для соблюдения требований EU AI Act, начавших действовать 2 августа 2026 года. Метки в изображениях и видео появились достаточно давно, но как поставить вотермарку в текст?
Ранее исследователи пробовали добавлять уникальные ключевые слова, невидимые или имеющие похожее написание символы. Пробел заменялся табуляцией, кавычки меняли форму, идентичные буквы брались из другого языкового набора.
Claude использует вариант технологии SynthID-Text: метка формируется не добавлением символов, а через выбор слов при генерации. LLM создает текст последовательно, слово за словом. Генерация идет через токены, то есть фрагменты слов, но для простоты опустим эту деталь. На каждом шаге модель предлагает несколько подходящих продолжений и выбирает одно из них с учетом вероятностей. При использовании вотермарки на выбор также влияют секретный ключ и несколько предыдущих слов.
Так в тексте появляется повторяющийся статистический рисунок. Он не содержит тайного сообщения, сведений о пользователе или номера чата. Одно выбранное слово ничего не доказывает, но в длинном тексте детектор может проверить, насколько часто последовательность слов совпадает с рисунком, заданным секретным ключом.
Для проверки не требуется исходный промпт: детектор берет предыдущие слова из самого текста и проверяет следующие токены с помощью ключа. На коротких фрагментах сигнал слабее, потому что в них мало подходящих вариантов выбора. В Anthropic сообщили, что готовят API для проверки текста на наличие водяного знака.
Полностью переписанный текст уничтожит вотермарку, но частичная редактура, скорее всего, не изменит результат детектирования. Существенная проблема технологии в том, что модели, обучающиеся на Claude посредством дистилляции, могут выдавать свой текст с той же вотермаркой. В краткосрочной перспективе это позволит поймать за руку китайские модели, но, вероятно, создаст путаницу в атрибуции текстов в будущем.
Стеганография на LLMНе так давно на GitHub появился проект Conversation Steganography. Он позволяет передавать секретные сообщения в тексте обычной переписки. Инструмент получает от LLM несколько вариантов следующего токена и выбирает тот, который кодирует очередную часть секретного послания.
Материалы из последних выпусков становятся доступны по отдельности только через два месяца после публикации. Чтобы продолжить чтение, необходимо стать участником сообщества «Xakep.ru».
Присоединяйся к сообществу «Xakep.ru»!Членство в сообществе в течение указанного срока откроет тебе доступ ко ВСЕМ материалам «Хакера», позволит скачивать выпуски в PDF, отключит рекламу на сайте и увеличит личную накопительную скидку! Подробнее
Вариант 2. Оформи подписку на материалы по тегуЕсли тебе интересна эта тема целиком, можно открыть доступ не к одному материалу, а ко всем платным статьям выбранного тега.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 2 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 3 | Claude empezará a marcar sus textos generados por IA (y me temo que copiar y pegar no eliminará el rastro) | 0 | 10.44 | 11-08-2026 |
| 4 | The Daily Telegraph: послание Наполеона расшифровали спустя 217 лет при помощи ИИ | 0 | 13.31 | 01-10-2026 |
| 5 | "НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных ... | 0 | 7.85 | 30-09-2026 |
| 6 | LLM уверенно называет шахматные ходы, которых на доске нет. Как я проверяю каждый ее ответ кодом | 0 | 5.87 | 26-09-2026 |
| 7 | 🙂 Dots — «Полностью новый способ работать с ИИ» Нового ... | 0 | 8.73 | 29-09-2026 |
| 8 | Комментарий к записи К чему ведёт не до конца понятая ИИ-зация – на примере (Гость) | 0 | 12.22 | 06-07-2026 |
| 9 | ИИ-помощник тимлида в закрытом контуре: что меняется в работе | 0 | 11.26 | 29-09-2026 |
| 10 | Визуальные токены | 0 | 5.76 | 24-09-2026 |