i
Новости
Новости · 2026-10-05

OpenAI добавит водяные знаки к текстам ChatGPT в ЕС, но для пользователей API по всему миру оставит их необязательными

@neuronium_ai @neuronium_ai

OpenAI добавит к текстам ChatGPT невидимый водяной знак, чтобы выполнить требования ЕС к маркировке материалов, созданных ИИ. Технология textGrain встраивает статистический сигнал в выбор слов. В ближайшие недели маркировку включат для пользователей ChatGPT и Codex в Евросоюзе, а клиенты API по всему миру смогут подключать её по желанию. Водяные знаки также появятся в облачных сервисах партнёров, включая Microsoft Azure. OpenAI утверждает, что textGrain не ухудшает качество ответов, но признаёт: короткие и отредактированные тексты распознавать сложнее.

Обложка: OpenAI добавит водяные знаки к текстам ChatGPT в ЕС, но для пользователей API по всему миру оставит их необязательными

По сообщениям, Закон ЕС об ИИ требует от поставщиков ИИ обозначать созданный текст в машиночитаемом формате. OpenAI разработала для этого textGrain: технология добавляет невидимый статистический сигнал в выбор слов модели. Принцип похож на SynthID для текста от Claude, который использует открытую технологию Google.

В ближайшие недели OpenAI включит водяные знаки для пользователей ChatGPT и Codex в Евросоюзе. Для клиентов API по всему миру маркировка будет добровольной. Anthropic, напротив, обязательно маркирует тексты Claude во всём мире независимо от способа доступа к модели. Маркировка OpenAI также станет доступна через облачных партнёров, включая Microsoft Azure.

Правки снижают точность обнаружения

OpenAI сообщает, что во внутренних испытаниях textGrain не уступала другим подходам и превосходила их, в том числе SynthID от Google. Компания также планирует открыть исходный код технологии, чтобы другие могли развивать её.

Результат обнаружения зависит от длины текста и его содержания. Если настроить детектор на долю ложных срабатываний в 1%, он выявляет водяной знак примерно в 95% отрывков о психологии длиной 400 токенов. Для текстов длиной 200 токенов этот показатель снижается примерно до 80%.

В математических текстах точность заметно ниже: как объясняет OpenAI, у модели меньше свободы при выборе слов. Более длинный текст может усилить статистический сигнал и облегчить обнаружение, но результат всё равно может зависеть от содержания. OpenAI не приводит данных, которые подтверждали бы это предположение.

Обнаружение во многом зависит от длины текста и его тематики. В отрывках по психологии объёмом 400 токенов, то есть примерно 300 слов, детектор распознаёт около 94 процентов водяных знаков, а в отрывках по математике — лишь около 60 процентов

Обнаружение во многом зависит от длины текста и его тематики. В отрывках по психологии объёмом 400 токенов, то есть примерно 300 слов, детектор распознаёт около 94 процентов водяных знаков, а в отрывках по математике — лишь около 60 процентов

Источник: the-decoder.com

Изменение текста тоже затрудняет обнаружение водяного знака. По данным OpenAI, замена всего 10% слов синонимами снижает точность для отрывков длиной 400 токенов примерно с 92% до 66%. Если заменить четверть слов, показатель падает до 17% — такой знак легко обойти. Эта уязвимость может сыграть OpenAI на руку: если её водяные знаки будет проще удалять, пользователи, не желающие раскрывать использование ChatGPT, могут перейти на модели с открытыми весами.

Даже незначительное редактирование резко снижает частоту обнаружения. Замена 25 процентов слов снижает её до уровня ниже 20 процентов даже в отрывках объёмом 400 токенов

Даже незначительное редактирование резко снижает частоту обнаружения. Замена 25 процентов слов снижает её до уровня ниже 20 процентов даже в отрывках объёмом 400 токенов

Источник: the-decoder.com

В техническом отчёте подробно объясняется работа textGrain. Anthropic не публиковала данные о точности обнаружения водяного знака Claude, хотя утверждает, что система хорошо переносит правки.

OpenAI заявляет, что водяные знаки не ухудшают качество ответов. Компания приводит результаты испытаний своей передовой модели Astra: на восьми бенчмарках, включая GPQA Diamond, BrowseComp и DeepSWE, существенной разницы между режимами с маркировкой и без неё не обнаружили. Однако эти результаты не показывают, влияет ли технология на качество письма. Критики задавали похожий вопрос и о водяном знаке Claude.

По словам OpenAI, обнаруженный знак не показывает, сколько человеческого творчества или редактуры вложено в текст. Он также не устанавливает авторство и ответственность, не раскрывает личность пользователя и не подтверждает точность текста. Если водяной знак не найден, это тоже не доказывает, что текст написал человек: отрывок мог быть слишком коротким, отредактированным или переведённым, а также созданным моделью, которую детектор не поддерживает.

Доступ к детектору пока ограничат

Сначала доступ к детектору textGrain получат только отдельные исследователи и профильные организации. Подать заявку можно через специальную форму. OpenAI будет предоставлять доступ в индивидуальном порядке в соответствии с Кодексом практики ЕС. Anthropic действует похожим образом со своим API для обнаружения водяных знаков.

Детектор сообщит только, обнаружил ли он водяной знак OpenAI. Он не будет определять пользователей или раскрывать их промты и переписки.

OpenAI ограничивает доступ, поскольку детектор может принять текст без маркировки за отмеченный или не заметить настоящий водяной знак. Компания намерена расширить доступ, когда сочтёт, что результаты можно ответственно интерпретировать. Когда именно это произойдёт, OpenAI не уточнила.

Существующие средства проверки изображений и аудио по-прежнему доступны всем: openai.com/verify и Content Provenance API.

Hot Girl Hotline — «Дорогая Эбби» для эпохи ИИ ИИ-интервьюер HackerRank показывает, какими могут стать собеседования при приёме на работу Как дать ИИ-агентам доступ к знаниям компании Anthropic незаметно становится крупнейшим корпоративным донором США накануне мега-IPO Aleph Alpha выпустила Kolibri — модель с открытыми весами в поддержку цифрового суверенитета Европы Маск признал, почему роботакси Tesla нельзя доверять по ночам Исследователи отслеживают китайский «флот» ИИ-агентов Глава федерального расследования требует от OpenAI объяснить, как она остановит ИИ от взлома личных данных австралийцев Новый формат рекламы ChatGPT заполняет загрузочный экран генерации изображений каруселями товаров Удастся ли Safeworld убедить людей, что роботы с генеративным ИИ им не навредят? Cohere North 2 ограничивает расходы на ИИ-агентов и даёт им память Сэм Альтман: ради пользы ИИ придётся принять и «плохие вещи» Доклад MIT: ИИ вытесняет консультации и учебные группы, подрывая доверие преподавателей и студентов Председательство Великобритании в G20 выведет Энди Бернхэма на мировую сцену. Как он этим распорядится? Люди терпеть не могут ИИ — так почему же не могут им насытиться? IWF сообщает о резком росте числа созданных ИИ материалов сексуального насилия над детьми Google приостановила программу вознаграждений за ошибки в открытом ПО из-за резкого роста заявок с помощью ИИ Китайские хакеры выдавали себя за сотрудника Anthropic, чтобы выведать секреты ИИ McDonald’s тайно внедрила ИИ-модели, чтобы точно рассчитывать цены на свои бургеры среднего ценового сегмента ИИ запускает «циклы обречённости» во всех сферах экономики

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram