i
ДАТАИСТ
Новости · 2026-08-27

Как работает текстовый водяной знак Claude

Будущие модели Claude будут создавать текст с водяным знаком — скрытым паттерном, по которому можно оценить вероятность участия Claude в написании материала. Anthropic и ещё несколько крупных поставщиков ИИ внедряют эту технологию для соблюдения Закона ЕС об ИИ. Водяной знак не виден читателю, не меняет качество, смысл, стоимость или скорость генерации и не содержит данных о пользователе. При этом он не доказывает, что текст написал человек или именно Claude, а лишь показывает вероятность участия Claude; чем длиннее фрагмент, тем увереннее проверка.

Обложка: Как работает текстовый водяной знак Claude

Как работает текстовый водяной знак Claude

Будущие модели Claude будут создавать текст с водяным знаком — скрытым паттерном, по которому можно оценить вероятность участия Claude в написании материала. Anthropic и ещё несколько крупных поставщиков ИИ внедряют эту технологию для соблюдения Закона ЕС об ИИ. Водяной знак не виден читателю, не меняет качество, смысл, стоимость или скорость генерации и не содержит данных о пользователе. При этом он не доказывает, что текст написал человек или именно Claude, а лишь показывает вероятность участия Claude; чем длиннее фрагмент, тем увереннее проверка.

Как работает водяной знак

Большие языковые модели, такие как Claude, генерируют текст по одному слову. Выбирая следующий вариант, модель оценивает список возможных слов с учётом уже написанного. В предложении «Сегодня погода была холодной и…» слово «сладкой» почти наверняка не подойдёт, а «пасмурной» или «серой» будут вполне вероятными. Для читателя выбор между двумя последними вариантами обычно не меняет смысла, поэтому его можно определить случайно.

Именно такие малозначимые решения, которые встречаются в тексте много раз, используются для создания водяного знака. Читатель его не замечает, но человек с особым ключом может проверить последовательность слов.

При обычной генерации модель использует произвольный генератор случайных чисел. При включённом водяном знаке источник случайности меняется: выбор определяется ключом и несколькими предыдущими словами. Сами слова по-прежнему выбираются случайно, но затем можно проверить, соответствует ли их последовательность решениям, которые Claude принимал бы при использовании этого ключа. Если соответствует, проверка выдаёт вероятность того, что текст создал Claude.

Это не означает, что модель теперь всегда будет предпочитать «пасмурную» или «серую». В одном предложении она может выбрать первый вариант, в другом — второй, в зависимости от предыдущих слов. Водяной знак также не заставляет Claude использовать слова, которые модель в обычной ситуации не рассматривала бы. Например, он не подтолкнёт модель к редкому слову nubilous — малоупотребительному синониму «пасмурного» или «серого».

Влияние на качество

Водяной знак не меняет качество ответов Claude. Для читателя ответ с маркировкой неотличим от ответа без неё. В этом он заметно отличается от водяных знаков на банкнотах, физических предметах и некоторых цифровых документах, которые видны невооружённым глазом.

Во внутренних тестах Anthropic не обнаружила влияния маркировки на содержание, творческий уровень и читаемость текста Claude. В работе SynthID-Text, где описан используемый подход, Google DeepMind включала модель с водяным знаком для части запросов Gemini и сравнивала оценки пользователей «нравится» и «не нравится». Статистически значимых отличий от модели без маркировки исследователи не нашли.

В отдельном контролируемом исследовании люди сравнивали ответы с водяным знаком и без него бок о бок и также не заметили разницы в качестве.

Понять принцип можно на примере «Монополии». В обычной игре игроки каждый ход перемещаются на случайное число клеток, выпавшее на кубике. Представим, что вместо броска используется последовательность цифр числа π. Игра начинается со случайно выбранной позиции — например, с цифры, стоящей на 1 012 845-м месте после запятой; там находится 6. Затем каждый следующий ход определяется следующей цифрой последовательности.

Для игроков и исхода партии движения всё равно выглядят случайными. Но если после игры известны все ходы и значение π, можно проверить, насколько вероятно, что использовалась именно эта последовательность. Такая партия оказывается условно «помеченной».

С текстом Claude происходит то же самое: водяной знак не меняет смысл и восприятие ответа, но позволяет задним числом оценить вероятность участия Claude.

Ограничения проверки

Технология отвечает только на вопрос о вероятности того, что текст был частично написан Claude. Она не подтверждает, что материал создан человеком, и не определяет, был ли он создан другой ИИ-системой. У другой модели будет другой ключ, а возможно, и совсем другой метод маркировки.

На небольших фрагментах проверка работает хуже: в них меньше решений, которые можно анализировать. По мере увеличения текста растёт и уверенность в оценке участия Claude.

В фактических пассажах водяной знак встречается реже. Там часто нет нескольких одинаково подходящих вариантов, поскольку замена слова может снизить точность. Например, в предложении «Самая известная работа Исаака Ньютона называлась Principia…» следующее слово должно быть «Mathematica» — другого правильного варианта нет. В таком месте водяному знаку нечего использовать.

То же относится к корректуре. Если передать Claude готовый текст и попросить исправить только грамматику и пунктуацию, маркировка сможет появиться лишь в нескольких исправлениях. Этого может оказаться недостаточно для обнаружения.

Водяной знак применяется только к словам, выбранным Claude. При корректуре человеческого текста почти все слова принадлежат автору, поэтому маркировать обычно нечего. В зависимости от длины материала и объёма правок этих изменений может не хватить для выявления участия Claude. Чем больше текста пишет Claude, тем больше решений принимает и тем больше возможностей оставить водяной знак.

Поэтому маркировка не используется там, где требуется точный результат: если другой вариант будет фактически неверным или нарушит работу кода. После записи «2 + 2 =» очевидный следующий элемент — «4». Если речь идёт о романе Джорджа Оруэлла «1984», правильным продолжением не может быть «5». В таких случаях дополнительное влияние водяного знака не применяется.

По той же причине код обычно маркируется слабее, чем другие виды текста: во многих случаях он должен быть точным. Однако в комментариях к коду, где возможен произвольный выбор слов, водяной знак использовать можно. На сам код это оказывает пренебрежимо малое влияние.

Скорость и данные пользователя

Нет. Водяной знак почти не влияет на скорость работы моделей и не создаёт дополнительных элементов текста. Поэтому стоимость использования и обслуживания модели не меняется.

Нет. Маркировка относится к Claude и его результатам, а не к отдельным пользователям. В самом водяном знаке и ключе нет сведений, по которым можно восстановить информацию о пользователе, его организации или переписке с Claude.

Зачем Anthropic внедряет маркировку

Anthropic вводит водяные знаки для соблюдения Закона ЕС об ИИ. В июле 2026 года компания вместе с несколькими крупными поставщиками моделей и примерно 190 другими подписантами присоединилась к Кодексу практики ЕС по прозрачности контента, созданного ИИ.

Документ требует от поставщиков ИИ-систем использовать методы маркировки текста, созданного ИИ. На старте Anthropic применяет водяной знак по всему миру, поскольку пока не располагает надёжным способом ограничить его отдельными регионами. Компания продолжит оценивать разные варианты и сообщит об изменениях.

В ближайшее время Anthropic собирается запустить API для обнаружения водяных знаков. Детали реализации пока прорабатываются.

Метаданные для файлов

Когда Claude создаёт файл поддерживаемого типа — например, `.png`, `.jpg` или `.svg`, — он добавляет в метаданные небольшую криптографически подписанную запись. В ней указано, что файл был создан или обработан с помощью Claude.

Для этого используется открытый отраслевой стандарт C2PA. Его применяют производители камер и разработчики фоторедакторов, чтобы фиксировать происхождение изображения. Любой инструмент с поддержкой C2PA сможет прочитать такую запись; Anthropic также предоставит собственный сервис, куда можно загрузить файл для проверки.

Такая метка в метаданных отличается от водяного знака. Содержимое файла не меняется, а сама запись не встраивается в изображение скрытым способом. Как и в случае с текстом, она сообщает только об участии Claude и не содержит идентифицирующих сведений.

Редактирование, перевод и авторство

В некоторой степени водяной знак можно ослабить редактированием. Лёгкая правка, вероятно, не удалит его полностью. Полная переработка, при которой заменяется каждое слово, уберёт маркировку. В таком случае уже можно спорить, допустимо ли по-прежнему называть текст созданным ИИ.

Водяной знак показывает лишь вероятность того, что Claude участвовал в работе с материалом. Он не различает ситуации «Claude написал текст» и «Claude сильно его отредактировал».

Перевод, выполненный Claude, получает водяной знак, поскольку в этом случае каждое слово выбирает модель.

Для моделей Anthropic, выпущенных до 2 августа 2026 года, Закон ЕС предусматривает переходный период. Компания также работает над добавлением водяных знаков в эти модели и собирается внедрить их в ближайшие месяцы.

Чем маркировка отличается от сервисов обнаружения ИИ

Программы для обнаружения текста, созданного ИИ, используют другой метод: у их разработчиков нет ключа Anthropic. Такие сервисы, среди прочего, анализируют характерные особенности формулировок ИИ — как явные, так и менее заметные.

Например, ИИ-модели часто используют конструкцию «это не [X], а [Y]» и слово «тихо» заметно чаще, чем можно было бы ожидать. Поиск подобных закономерностей принципиально отличается от проверки водяного знака.

Права на контент

Нет. Водяной знак позволяет лишь проверить, мог ли Claude создать или обработать материал. Он ничего не говорит о владении содержимым или авторстве и не меняет права пользователя, закреплённые в условиях Anthropic. Маркировка применяется только в тех случаях, когда Claude участвовал в обработке текста или файла.

Другие инициативы Anthropic

Anthropic открывает исследовательскую версию «Стандарта аппаратного обеспечения моделей» (MHS) — общей спецификации, которая должна позволить ИИ-агентам безопасно работать с физическими устройствами. На первом этапе доступ получат научно-исследовательские лаборатории и передовые производители.

С сегодняшнего дня 10 000 учёных по всему миру могут бесплатно начать пользоваться Claude. Проверенные руководители исследований получают право на тариф Claude Team, после чего смогут бесплатно добавить свою исследовательскую группу на стандартные места или подключить премиальные места за $15 в месяц сроком до одного года.

Кроме того, Anthropic запускает грантовую программу на $5 млн для независимых исследований влияния ИИ на благополучие пользователей.

Источник: anthropic.com

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram