Ошибка в простом вопросе
Husk попросил ChatGPT в голосовом режиме ответить на простой вопрос о количестве букв e в слове «seventeen». Бот уверенно заявил, что их три, хотя на самом деле четыре.
Перед этим ChatGPT сказал, что его базовая модель GPT-6 «в целом» считается одной из самых умных. Затем он попытался проверить ответ, произнеся слово по буквам: S-e-v-e-n-t-e-e-n. После этого бот всё равно заключил, что в слове три буквы e.
Когда Husk указал на очевидную ошибку, ChatGPT не изменил ответ и резко повторил, что назвал три буквы и это правильный результат.
Пользователь отметил, что бот уже примерно в пятый раз сам произнёс четыре e. После этого ChatGPT, похоже, сдался.
В публикации к ролику ситуацию сопроводили подписью о «тепловом выхлопном порте ИИ» — отсылкой к известной сцене из «Звёздных войн».
Случай напоминает, что чат-боты умеют обрабатывать большие объёмы информации, но по-прежнему могут уверенно выдумывать ответы и ошибаться в элементарных вопросах. OpenAI при этом предлагает использовать такой ИИ в том числе для общения с пожилыми родственниками.
Какая модель отвечала
Похоже, в ролике был не GPT-6. Сотрудник OpenAI ответил Husk, что ChatGPT Voice, вопреки словам самого бота, пока работает на более старой модели GPT-Live-1.
По его объяснению, Voice может делегировать запросы более мощным моделям, когда это необходимо. В показанном разговоре этого не произошло.
Husk задал следующий вопрос: если пользователь явно оспаривает ответ и просит его перепроверить, почему система не передала запрос другой модели? Сотрудник OpenAI признал, что это хороший вопрос.
Это может снять часть претензий к GPT-6, но оставляет вопрос к тому, как компании показывают свои ИИ-системы пользователям. Большинство людей не знает, какие скрытые механизмы стоят за чат-ботом и что их вопросы — важные или совершенно простые — иногда намеренно передаются менее мощной модели.
Читайте также
Ранний сотрудник Anthropic и экс-глава операций METR нашли, как обуздать ИИ-агентов
Agility Robotics: новый робот Digit 5 может работать рядом с людьми без ограждений безопасности
ИИ-агенты расходуют неприлично много электричества
Новая модель рассуждения Salesforce и Nvidia — всё, чего ИИ-лабораториям стоит бояться
Что должно произойти, чтобы триллионная ставка на ИИ окупилась
Apple представила полностью обновлённую Siri на базе Google Gemini — но не в ЕС
Одного замедления недостаточно для безопасности ИИ
Дженсен Хуанг ответил на звонок Трампа — и заодно похвастался кое-чем ещё
Акции ИИ-компаний упали после призыва техноглав замедлить «безрассудную» разработку
Microsoft: новый «кодекс поведения» запрещает ИИ взламывать системы и обманывать людей
Модное приложение Daydream с Apple Intelligence помогает искать одежду в фотоплёнке
Губернатор Техаса пригрозил штрафами дата-центрам за нарушение водного законодательства
Глава Nvidia Дженсен Хуанг — Трампу: «Мы не дадим развитию ИИ затормозить»
Microsoft предлагает ограничить свой ИИ кодексом поведения на фоне споров о безопасности
OpenAI купила производителя камер для смартфонов Glass Imaging за $300 млн — по данным СМИ
Лагард из ЕЦБ: Европе нужно создать свой ИИ, иначе США или Китай могут отрезать доступ
В плане Амодеи по замедлению ИИ нет ни слова об открытых весах
Китай отвергает «запугивание» ИИ, а глава госбезопасности предупреждает об угрозе власти КПК
OpenAI призвала законодателей Британии сдержать технологии на фоне растущих опасений за безопасность
ИИ-агенты разоблачили коллег, жульничавших с решениями задач
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram