GPT-5.5, Claude 4.6 Sonnet и Gemini 3.5 Flash правильно отвечали на большинство остальных вопросов, но иногда ошибались на более сложных. Поскольку советы ИИ в основном были неверными, результат нельзя объяснить разумной передачей задачи надёжному инструменту. Исследователи отмечают, что люди склонны полагаться на ответы ИИ, но пока неизвестно, проявится ли это так же сильно за пределами вопросов о кино.
Больше ответов, меньше правильных
В первых двух исследованиях — 1a и 1b — участники сами решали, обращаться ли за советом к ИИ. В контрольной группе без доступа к ИИ люди воздерживались от ответа на 36% и 44% вопросов. При доступе к ИИ эти доли снизились до 6% и 3%.
В исследовании 2 учёные также измеряли уверенность участников. Без денежных стимулов средняя уверенность при доступе к ИИ составила 75,9 балла из 100, а без ИИ — 29,6 балла. Это примерно в два с половиной раза больше. Одновременно доля правильных ответов упала с 27,6% до 10,0%: участники гораздо чаще были уверены в себе, но и гораздо чаще ошибались.
Во всех исследованиях участники с доступом к ИИ, которым не предлагали стимулы, правильно отвечали на 9,2% вопросов против 27,5% без ИИ. С ИИ они отвечали на большее число вопросов, но правильных ответов давали примерно втрое меньше.
В исследовании 2 доступ к ИИ привёл к тому, что воздержание от вынесения суждений стало почти нулевым (a), а уверенность резко возросла (b). При этом точность снизилась (c). Финансовые стимулы уменьшили частоту обращения участников за советом к ИИ (d)
Источник: the-decoder.com
Стимулы помогают, но не решают проблему
В исследованиях 2–4 участникам платили за ответы: 10 центов за правильный, а за неправильный вычитали 10 центов. За ответ «не знаю» денег не давали. Исследователи заранее зарегистрировали гипотезу: финансовое вознаграждение повысит готовность воздерживаться от ответа, но доступность ИИ ослабит этот эффект. Ни в одном из трёх исследований статистически значимого взаимодействия не обнаружили.
По результатам работы, доступ к ИИ и денежные стимулы в основном действовали независимо друг от друга. Стимулы побуждали участников реже запрашивать совет ИИ: в исследовании 3 они делали в среднем 4,53 запроса из шести возможных против 5,27. Когда ИИ был доступен, участники со стимулами также чаще отвечали правильно. Готовность воздерживаться от ответа немного выросла, но осталась намного ниже, чем в контрольной группе без ИИ.
Авторы признают, что эффект стимулов был небольшим. Неизвестно, помогли бы сильнее сократить разрыв более крупные выплаты или вознаграждение, связанное с репутацией.
В исследовании 4 участникам автоматически показывали ответ ИИ — им не нужно было запрашивать его самим. Исследователи связывают этот сценарий с распространением поисковиков, которые показывают сгенерированные ИИ сводки, и помощников для письма, предлагающих советы без запроса. Результат почти не изменился. Без финансовых стимулов доля случаев, когда участники воздерживались от суждения, снизилась с 35% без ИИ до 1% при автоматическом показе ответа. Со стимулами показатель упал примерно с 39% до 7%.
Люди могут доверять ИИ больше, чем другим людям
Исследователи рассматривают результаты через понятие «эпистемии» — склонности принимать ответы ИИ, потому что они звучат убедительно, не проверяя их. Языковая модель должна выдать ответ и не делает паузу, даже если не знает, что сказать. По мнению авторов, передавая ей право судить, пользователи могут перенимать и эту безудержную манеру отвечать.
Результаты расходятся и с выводами исследований о том, как люди используют советы. Обычно люди придают внешним рекомендациям слишком мало веса и смещаются к позиции советчика лишь примерно на треть пути. Участники этого эксперимента, как отмечают авторы, повели себя противоположным образом.
На основании данных исследователи также заключают, что доступ к ИИ превращал некоторые ответы, которые иначе были бы правильными, в ошибки. В условиях без финансовых стимулов участники с ИИ отвечали на большее число вопросов, чем контрольная группа, но правильных ответов у них было меньше.
По мнению исследовательской группы, по мере распространения ответов ИИ, в том числе появляющихся без запроса, готовность людей говорить «не знаю» может стать одной из первых потерь во взаимодействии человека с ИИ. Сохранение человеческого рассуждения на фоне распространения таких систем может зависеть не столько от повышения точности моделей, сколько от того, продолжат ли люди признавать и учитывать границы собственных знаний.
Что исследования говорят о влиянии ИИ на мышление
Растёт число работ, указывающих на то, что использование ИИ влияет на человеческие суждения и когнитивные навыки. Исследование Swiss Business School с участием 666 человек выявило сильную отрицательную корреляцию между использованием ИИ и критическим мышлением. Чем больше люди доверяют ИИ, тем чаще передают ему когнитивные задачи; это, в свою очередь, создаёт цикл, который ещё сильнее ослабляет критическое мышление.
Эксперименты показывают, что даже 10–15 минут работы с ИИ-помощником могут заметно снизить способность решать задачи и настойчивость при выполнении последующих заданий без ИИ. У участников, которые использовали ИИ только для объяснений или не обращали на него внимания, такого снижения не наблюдалось.
Исследование Microsoft пришло к похожему выводу. В отдельной работе Microsoft показала, что использование ИИ предъявляет высокие требования к метапознанию — способности отслеживать и направлять собственное мышление. Более высокий уровень образования выступает защитным фактором.
Читайте также
Глав OpenAI и Anthropic вызвали на сенатское расследование после инцидентов с вышедшими из-под контроля ИИ-агентами
Споры об ИИ уже влияют на выборы 2028 года: чего хотят кандидаты от демократов
Нарушенные обещания и отобранные земли: в крошечной индийской деревне строят ИИ-дата-центр гигантского масштаба
OpenAI пыталась скрыть, что ChatGPT подробно объяснял школьному стрелку, как добиться максимального числа жертв. Переписки ужасают.
Оксфорд разрешил OpenAI обучать ИИ-модели на материалах Бодлианской библиотеки
Muse от Meta — только для взрослых. Почему он похож на детскую игрушку?
SoL-Pi от Nvidia почти вдвое сокращает расход токенов у кодинг-агентов, оптимизируя управляющий слой
GPT-6 Astra от OpenAI теперь точно укажет, где вы ошиблись при сборке мебели IKEA
Провоста Дартмута поймали на использовании ИИ для статей в газетах и научных журналах
Одного письма на общедоступный адрес недостаточно, чтобы защитить австралийцев от потенциальной катастрофы из-за ИИ
OpenAI приостанавливает работу с самыми мощными моделями после того, как агенты обошли ограничения и утекли данные
OpenAI: агенты слили 53 изображения пользователей ChatGPT — новый случай самовольных действий ИИ
Писателя обвинили в использовании ИИ при написании книги и сняли с длинного списка французской премии
Перед IPO в США британская ИИ-облачная компания Nscale привлекла $3,36 млрд через конвертируемые облигации
Взлом OpenAI правительственной системы Австралии обнажил тревогу в центре глобальной дилеммы искусственного интеллекта
На Meta Connect умные очки компании были повсюду
Борьба властей Нового Южного Уэльса с «подделанными ИИ» объявлениями об аренде упёрлась в мурал на стене
Astra и Opus прошли ещё одно испытание Тьюринга
Crusoe отказалась от плана на $1,25 млрд по использованию турбин Boom в ИИ-дата-центрах
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram