Как искали признаки ИИ-текста
Чтобы сравнение было честным, Graphite собрала 10 000 статей, опубликованных до выхода ChatGPT, и использовала их как образцы человеческого текста. Затем разные модели переписали эти статьи по кратким пересказам — так исследователи постарались уменьшить влияние исходных текстов. Сопоставив образцы людей и каждой модели, они сравнили частоту слов и выражений, а также более общие особенности построения предложений.
Для Graphite «признак» — это выражение, которое в текстах ИИ встречается как минимум вдвое чаще, чем в текстах людей. Таких выражений исследователи нашли 13 000.
Что выдает разные модели
У Claude Opus 5.5 самый заметный признак — слово «надёжный»: в выборке оно встречается в 23 раза чаще, чем в человеческих текстах. Модель теперь избегает конструкции «не X, а Y», но часто использует другую: «это больше, чем X, это Y».
Особенно часто Opus 5.5 поясняет, почему что-то важно. Выражение «это важно» встречается в его текстах в 116 раз чаще, чем в человеческих, а конструкция «почему X важно» — в 92 раза чаще.
У OpenAI Astra свои речевые привычки. Модель любит говорить о «другом измерении» темы и смягчать утверждения формулировками вроде «может принести» или «может обеспечить» определённую пользу. Самый заметный признак Graphite назвала «корректирующей рамкой»: модель описывает предмет как «не просто X» или противопоставляет его чему-либо с помощью оборота «вместо того чтобы полагаться на X». По данным Graphite, такие конструкции в текстах Astra встречаются более чем в 100 раз чаще, чем в текстах людей.
Длинное тире стало встречаться реже
Похоже, все разработчики передовых моделей отреагировали на разговоры о чрезмерном использовании длинного тире. В выборке Graphite Opus 5.5 использовала его на 99% реже, чем Opus 5. Astra ставит его на 88% реже, чем люди, а Gemini 3.1 Pro почти полностью отказалась от этого знака.
При этом общее число характерных признаков, по оценке Graphite, в основном остаётся прежним. Друк рассказал TechCrunch, что модели учатся убирать самые известные речевые привычки, но на их месте появляются другие, причём у каждой версии свои.
Такая устойчивость признаков примечательна на фоне того, что разработчики стремятся сделать стиль моделей более похожим на человеческий. Выпуская Opus 5.5, Anthropic заявила, что модель общается естественнее предыдущих версий, а первые пользователи сочли её текст более ясным и удобным для чтения.
OpenAI высказывала похожие заявления при выпуске версий GPT-6 Sol и Luna: пользователям обещали более ясный текст, меньше жаргона и меньше странных оборотов.
Друк сомневается, что разработчики могут полностью убрать характерные выражения и конструкции. По его предположению, лаборатории хуже контролируют такие особенности, чем принято думать: у огромных моделей с миллиардами параметров можно проверить лишь ограниченное число вариантов, и некоторые привычки остаются незамеченными.
Читайте также
WikiSkill от Google наделяет ИИ-агентов памятью
Amazon представила быструю бесплатную модель с открытым кодом в противовес Jev: Strands Decider 2B принимает решения за доли секунды
Похоже, это старые твиты сотрудника Anthropic, уволившегося из-за угрозы человечеству, — и они… весьма странные
Брайан Чески: ИИ-агентам нужна собственная операционная система
Anthropic выводит Claude в гражданские ведомства, пока конфликт с Пентагоном затягивается
Команда Olmo представила Olmo-core 3 — открытую масштабируемую инфраструктуру для обучения больших MoE-моделей
Новая кисть робота Atlas может превзойти человекоподобные конструкции
Anthropic добивается права обучать модели на контенте из Австралии с возможностью отказа, а ABC предупреждает: ИИ «поглотит» новости
Стартап в сфере кибербезопасности нашёл более 13 000 скриншотов из внутренних систем компаний, которые ИИ-агенты выложили в открытый доступ
Высокопоставленный руководитель BBC посмотрел полностью созданный ИИ эпизод «Доктора Кто» и назвал его «неплохим»
Photon устроила похороны мобильных приложений. Теперь у неё есть $4,5 млн, чтобы заменить их агентами
ИИ обыграл сильнейшего игрока в Stratego, покончив с одним из последних оплотов людей в настольных играх
Satlyt, основанная бывшим продакт-менеджером Google и SpaceX, привлекла $8 млн на запуск ИИ на спутниках
OpenAI пресекла кампанию по краже рассуждений своих моделей, но на Azure уловка сработала
Аналитики предупреждают: дата-центры могут стать бомбой замедленного действия на $6 трлн
Как старейший ИИ-стартап пытается защитить себя от пузыря изнутри
ИИ научился «читать мысли» и восстанавливать увиденное по снимкам мозга
ИИ-чат-боты снимают хиджабы с изображений мусульманок по просьбе пользователей
Забудьте о «сверхразуме»: из-за ошибки ИИ в этом месяце мир едва не оказался на пороге третьей мировой войны
Barclays масштабирует Claude, чтобы модернизировать работу и улучшить обслуживание клиентов
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram