Как работает текстовая водяная метка Claude
Anthropic добавит водяные метки в текст будущих моделей Claude. Они не меняют смысл, качество, скорость или цену ответов, но позволяют по специальному ключу оценить вероятность того, что Claude участвовал в написании текста. Метка основана на выборе слов в случаях, когда подходят несколько вариантов, и не видна читателю. Anthropic внедряет её по всему миру, чтобы выполнить требования Закона ЕС об ИИ, а позже обещает API для проверки. Для файлов Claude будет использовать отдельные криптографические удостоверения C2PA.
Как устроена метка
Большие языковые модели вроде Claude создают текст по одному слову. На каждом шаге модель выбирает следующий вариант из списка возможных, ориентируясь на предыдущий контекст. В предложении «Сегодня погода была холодной и…» слово «сладкой» почти наверняка не подойдёт, а «пасмурной» или «серой» будут естественными продолжениями. При этом для читателя разница между последними двумя вариантами обычно невелика. В подобных случаях выбор определяется случайным числом.
Водяная метка использует множество таких малозначимых решений, которые встречаются в сгенерированном тексте, чтобы оставить в ответе определённый рисунок. Читатель его не заметит, но обнаружить сможет тот, у кого есть специальный ключ.
При включённой метке слова по-прежнему выбираются случайным образом, однако источник случайности меняется. Вместо обычного генератора модель использует ключ и несколько предшествующих слов. Поэтому последовательность остаётся случайной, но её можно проверить: соответствует ли она выборам, которые Claude сделал бы при использовании этого ключа. Если соответствует, проверяющий может рассчитать вероятность участия Claude в создании текста.
Метка не заставляет модель постоянно выбирать «пасмурную» или «серую». В одном предложении может появиться первый вариант, в другом — второй: всё зависит от предыдущих слов. Она также не подталкивает Claude к словам, которые модель обычно не выбрала бы. Например, метка не заставит её использовать редкое слово «туманный» вместо обычных вариантов.
Влияние на ответы
Водяная метка не снижает качество текста Claude. Для читателя ответ с меткой неотличим от ответа без неё. В этом она заметно отличается от водяных знаков на банкнотах, физических предметах и некоторых цифровых документах, которые видны невооружённым глазом.
Внутренние испытания Anthropic не выявили влияния метки на содержание, творческий уровень или читаемость текста. В работе о SynthID-Text, опубликованной Google DeepMind, исследователи включали метку для части запросов к Gemini и сравнивали оценки «нравится» и «не нравится». Статистически значимых различий с моделью без метки они не обнаружили. В отдельном контролируемом исследовании люди, сравнивавшие ответы с меткой и без неё бок о бок, также не увидели разницы в качестве.
Принцип можно сравнить с игрой в «Монополию». Обычно игроки бросают кубик и передвигаются на случайное число клеток. Представим, что вместо кубика используется последовательность цифр числа π. Игра начинается со случайно выбранной позиции — например, с цифры, стоящей на 1 012 845-м месте после запятой, а затем игроки используют следующие цифры как результаты бросков.
Для участников и самого исхода игры движения всё равно выглядят случайными. Но если после партии изучить всю последовательность ходов и знать значение π, можно проверить, насколько вероятно, что использовалась именно эта последовательность. В этом смысле партия оказывается «помеченной».
С текстом Claude происходит то же самое: метка не меняет смысл и восприятие ответа, но позволяет задним числом проверить вероятность участия Claude.
Метод Claude — это версия подхода SynthID-Text, который Google DeepMind описала в статье в журнале Nature в 2024 году. Подобные методы относятся к семейству решений, восходящих к предложению Скотта Ааронсона в 2022 году. Их общий принцип — менять только источник случайности при выборе между подходящими словами.
Ограничения метода
С ключом Anthropic можно ответить только на вопрос: насколько вероятно, что Claude частично написал этот текст. Метка не подтверждает, что текст создал человек, и не показывает, использовалась ли другая модель. Даже если у другой модели есть собственная метка, у неё будет другой ключ, а сам метод может отличаться.
На коротких фрагментах обнаружение работает хуже: в них меньше вариантов выбора и, следовательно, меньше данных для проверки. Чем длиннее текст, тем выше уверенность в оценке участия Claude.
В фактических фрагментах метка проявляется реже, потому что там меньше безопасных вариантов. Например, после фразы «Самая известная работа Исаака Ньютона называлась Principia…» правильным продолжением будет только «Mathematica». Выбирать здесь не из чего, поэтому метке не на что влиять.
Та же проблема возникает при корректуре. Если попросить Claude исправить только грамматику и пунктуацию, метка сможет использовать лишь несколько исправлений — этого может оказаться недостаточно для обнаружения.
Метка относится только к словам, которые выбирает Claude. Когда модель корректирует текст человека, почти все слова остаются авторскими, а правки обычно ограничиваются небольшими изменениями. В зависимости от длины текста и масштаба редактирования этого может не хватить, чтобы зафиксировать участие Claude. Чем больше модель пишет самостоятельно, тем больше решений принимает и тем больше материала для метки.
Водяная метка использует ситуации, когда между несколькими словами нет существенной разницы. Если требуется точный результат, она не применяется. После записи «2 + 2 =» лучшим следующим элементом текста будет «4»: другой вариант окажется фактически неверным. Если модель рассуждает о романе Джорджа Оруэлла «1984», таким же единственным подходящим ответом будет «5» в соответствующем контексте. В подобных местах метка не вносит никаких изменений.
Поэтому код обычно маркируется слабее, чем другие типы текста: во многих случаях он должен быть точным, и замена термина может привести к ошибке. Исключение — произвольные элементы вроде комментариев в коде. Там метка возможна, но на сам выполняемый код она по определению влияет пренебрежимо мало.
Скорость, пользователи и закон
Водяная метка почти не влияет на скорость работы моделей. Она не создаёт дополнительных единиц текста, поэтому стоимость использования и обслуживания Claude не меняется.
Метка относится к Claude и его ответам, а не к отдельным пользователям. В ней и в ключе нет данных, по которым можно было бы восстановить сведения о человеке, его организации или переписке с Claude.
Anthropic внедряет метки для соблюдения Закона ЕС об ИИ. В июле 2026 года компания вместе с другими крупными поставщиками моделей и примерно 190 другими подписантами присоединилась к Кодексу практики ЕС по прозрачности контента, созданного ИИ. Документ требует от поставщиков ИИ-систем использовать методы «маркировки» такого текста.
В начале водяная метка будет применяться по всему миру: у Anthropic пока нет надёжного способа ограничить её отдельными регионами. Компания продолжит изучать разные варианты и сообщит об изменениях.
В ближайшее время Anthropic также собирается открыть API для обнаружения метки. Сейчас компания уточняет детали его реализации.
Метаданные для файлов
Когда Claude создаёт файл поддерживаемого типа — например, .png, .jpg или .svg, — он добавляет в метаданные небольшое криптографически подписанное удостоверение. В нём указано, что файл был создан или обработан с помощью Claude.
Это открытый отраслевой стандарт C2PA, который используют производители камер и программы для редактирования фотографий, чтобы фиксировать происхождение изображения. Прочитать такие данные сможет любой инструмент с поддержкой C2PA; Anthropic также предоставит собственную службу, куда можно загрузить файл для проверки.
Такое удостоверение устроено иначе, чем водяная метка. Файл не изменяется, а информация не скрывается внутри него. Как и текстовая метка, удостоверение сообщает только об участии Claude и не содержит идентифицирующих данных.
Редактирование и перевод
Лёгкое редактирование, вероятно, не удалит метку полностью. Полная перепись, при которой заменяется каждое слово, её уберёт. В таком случае, отмечает Anthropic, уже можно спорить, насколько корректно называть получившийся текст созданным ИИ.
Метка показывает лишь вероятность того, что Claude участвовал в работе с материалом. Она не различает ситуации «Claude написал текст» и «Claude существенно его отредактировал».
Перевод, выполненный Claude, получает метку, поскольку в таком случае каждое слово выбирает модель.
Для моделей Anthropic, выпущенных до 2 августа 2026 года, Закон ЕС предусматривает переходный период. Компания работает над добавлением метки и в них; развёртывание займёт ближайшие месяцы.
Отличие от сервисов проверки ИИ
Программы для обнаружения текста, созданного ИИ, используют другой подход: у их разработчиков нет ключа Anthropic. Такие службы, среди прочего, анализируют характерные особенности формулировок — как явные, так и едва заметные.
Например, модели ИИ часто используют конструкцию «это не [X], а [Y]» и слово «тихо» заметно чаще, чем можно было бы ожидать. Поиск подобных закономерностей принципиально отличается от проверки водяной метки.
Права на содержимое
Водяная метка помогает проверить только возможное участие Claude в создании или обработке материала. Она ничего не говорит о праве собственности или авторстве и не меняет права пользователя, закреплённые в условиях Anthropic.
Метка применяется лишь тогда, когда Claude действительно участвовал в обработке содержимого или файла.
Другие инициативы Anthropic
Anthropic открывает исследовательскую предварительную версию Стандарта аппаратного обеспечения моделей (MHS) — общей спецификации, которая должна позволить ИИ-агентам безопасно работать с физическими устройствами. На первом этапе доступ получат научно-исследовательские лаборатории и передовые производители.
С сегодняшнего дня 10 000 учёных по всему миру могут бесплатно начать пользоваться Claude. Проверенные руководители исследований получают подписку Claude для команд, а затем добавляют участников своей команды: стандартные места предоставляются бесплатно, премиальные стоят $15 в месяц. Льгота действует до года.
Кроме того, Anthropic запускает грантовую программу на $5 млн для независимых исследований влияния ИИ на благополучие пользователей.
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram