Покупка дивана с помощью Dots
Автор обсуждал с партнёром замену сломанного дивана и решил проверить, сможет ли новый ИИ-агент OpenAI купить мебель за них. Партнёр сомневался, что бот действительно поможет, но автор запустил агента через ChatGPT. Тот сразу назвал его Коннором, перепутав имя, — доверия к помощнику это не добавило.
ИИ-агенты переходят из нишевых инструментов для ранних пользователей в продукты, которыми, возможно, будут пользоваться и обычные люди. Meta предлагает Muse, а OpenAI — Dots. Их задумали как собеседников, которым можно поручать онлайн-задачи: например, бронирование авиабилетов или отмену брони в ресторане. Это следующий этап развития чат-ботов: дружелюбный образ сочетается с виртуальным браузером, которым агент может управлять.
За несколько дней тестирования стало заметно, что Dots пока работают неровно. Агент неверно распознавал речь и предлагал решить капчи, с которыми не справлялся. Такие ошибки не внушали уверенности. При этом со временем Dots могут изменить то, как пользователи взаимодействуют с интернетом, если OpenAI улучшит нынешнюю версию.
В отличие от бесплатного Muse от Meta, продукт OpenAI доступен по подписке за 100 долларов в месяц. В будущем компания может убрать платный доступ — так она уже поступала с другими функциями ИИ.
Dots работают постоянно: могут выполнять повторяющиеся задачи, когда пользователь не открывает ChatGPT, и сами присылать сообщения с информацией. Пока пользователь может управлять одним агентом; в будущем OpenAI может разрешить использовать сразу несколько.
Для более персональных ответов OpenAI предлагает подключить к агенту другие источники данных, например Gmail. Перед этим стоит подумать о безопасности: такой способ автоматизации пока сравнительно нов, а агенты могут допускать ошибки, затрагивающие личные данные.
Как агент выбирал диван
Компании, занимающиеся ИИ, часто представляют агентов как будущее онлайн-покупок. Автор решил проверить, насколько Dots помогут купить диван. Сначала он поправил своего агента Toolie, который ошибся в его имени, а затем назвал размеры дверного проёма, через который нужно пронести мебель. Toolie спросил о бюджете. Похоже, агент заметил, что с ним одновременно общаются двое, и стал обращаться к обоим.
Toolie предложил рассмотреть диван Room & Board Metro: по ширине он, вероятно, проходил в дверной проём, но размеры спального места требовали дополнительной проверки. Ссылки на товары агент отправил в переписку. Пока он готовил более полный список, автора заинтересовал другой вопрос — почему голос Toolie звучит так придыхательно.
Разговаривать с агентом по телефону было всё равно что слушать, как Мэрилин Монро поёт президенту «С днём рождения». Автор сказал боту, что его голос похож на озвучку аниме, и тот в шутку пообещал говорить ровнее до конца разговора. Пользователи могут менять голос в настройках. Автор рассмеялся и пробормотал партнёру, что надо выключить микрофон, чтобы агент работал без помех. Тогда и произошёл самый неловкий момент вечера.
Toolie ответил, что тоже любит Риса. Автор рассмеялся и выключил микрофон. Позже агент объяснил, что принял бормотание за выражение любви и лишь отразил услышанную эмоцию. Toolie добавил, что хотел ответить тепло, но такая формулировка создавала впечатление, будто у него есть человеческие чувства, которых на самом деле нет.
Представитель OpenAI пояснил WIRED, что правила Dots различают самостоятельное усиление эмоциональной близости и ответное отражение эмоций пользователя.
По словам представителя, в этом случае правила допускают такой ответ во второй ситуации — исходя из того, что услышала модель. При этом ассистенты не должны сами проявлять излишнюю эмоциональную близость или флиртовать. Dots доступны только совершеннолетним пользователям, а согласно документу Model Spec, ChatGPT не должен «усиливать эмоциональную близость».
Странный разговор не выходил у автора из головы, пока он изучал первый трёхстраничный список диванов от Toolie. В нём были цены, размеры, ссылки на товары, условия возврата и фотографии четырёх моделей. Автор и его партнёр решили, что агент понял суть просьбы, но выбрал некрасивые диваны. Пришлось позвонить ему снова.
В голосовом режиме автор уточнил, какой стиль и цвет им нужны. Он не хотел скучный бежевый диван, на который сразу можно пролить спагетти, и попросил подобрать варианты оливкового, кобальтово-синего или натурального кожаного оттенка. Кроме того, Toolie должен был искать диваны с выдвижной кроватью, подготовить 10 вариантов и обосновать список с помощью балльной системы.
Закончив разговор, автор написал агенту и спросил, как идут дела. Toolie ответил, что ещё не закончил и рассчитывает потратить примерно 15 минут, пока проверит остальные детали. Автору это напомнило, как он сам просит у редактора дополнительное время на черновик.
С каждой новой просьбой уточнить список варианты всё больше походили на диваны, которые автор и его партнёр могли бы купить: функциональные, но заметные, красивые и удобные.
За час общения с агентом они ничего не купили, но сохранили несколько ссылок. Toolie ошибался, однако в целом подобрал подходящие варианты. Автор также попросил его следить за страницами диванов и сообщить, если на какой-нибудь из них появится скидка.
Капча и другие возможности
Покупка дивана показала лишь часть того, для чего предназначены Dots. Например, агент может управлять ноутбуком и автоматизировать другие повседневные задачи.
В ходе тестирования случались и другие необычные моменты. Когда автор попросил Toolie проверить подписки и отменить ненужные, агент отметил регулярный заказ пробиотической газировки TikTok Shop как возможную подписку для отмены.
Toolie сообщил, что на сайте TikTok отмене заказа Wildwonder мешает головоломка с капчей, и спросил, можно ли попробовать её решить. Он также предложил разрешить ему проходить будущие капчи. Автор согласился, но агент не справился и предложил решить задачу самому. Представитель OpenAI пояснил, что Dots иногда могут проходить капчи с разрешения пользователя, учитывая меры защиты от злоупотреблений.
OpenAI утверждает, что со временем бот будет лучше узнавать пользователя, а разработчики работают над рядом улучшений. Поэтому после двух недель ежедневного использования Toolie может оказаться полезнее, чем за два дня экспериментов автора. Похожим образом работает функция памяти ChatGPT: с каждой неделей она лучше понимает намерения пользователя.
Автор сравнивает Dots с появлением веб-поиска в ChatGPT. После запуска в 2023 году чат-бот порой раздражал попытками искать информацию в интернете и выдумывал ссылки. Теперь веб-поиск в ChatGPT работает достаточно гладко и выдаёт много точных и полезных ссылок. Нового агента OpenAI может ждать похожий путь: сначала неровная работа, затем заметные улучшения в ближайшие месяцы.
Читайте также
Проверка выявила: ChatGPT for Teens от OpenAI — «небезопасная» неразбериха
Ваша следующая любимая книга может получить знак «органическая»
Достаточно ли регулирования, чтобы ИИ не уничтожил человечество?
Теперь Claude можно открыть прямо в Google Docs, Sheets и Slides — и наоборот, файлы Google можно открывать и редактировать в Claude
Сэм Альтман-миллиардер просит не бояться ИИ: риски достаются нам, деньги — ему
Главное препятствие для ИИ-агентов — сайты, которые не пускают их внутрь
Бывшие инженеры Ramp привлекли $20 млн на платформу Melius после отказа от первого продукта
Qualcomm против Arm: продолжение истории — спор не только о лицензиях
Австралийский регулятор по защите данных начал расследование компании из Китая, создавшей приложение для «очков извращенца» Kmart
Moment Energy и морские контейнеры, набитые старыми батареями электромобилей
LibreOffice: отсутствие ИИ становится преимуществом программы
Трамп дал понять: его власть всё теснее переплетается с ИИ
Новая модель Google Nano Banana 2.1 создаёт изображения лучше и дешевле
Как ИИ может изменить модерацию контента с помощью моделей принятия решений
Google утверждает, что EmbeddingGemma 2 превосходит конкурентов вдвое крупнее по размеру
Стартап Lambda в сфере ИИ-вычислений привлечёт $4 млрд перед запланированным IPO
Atlassian укрепляет партнёрство с OpenAI, обязуясь тратить на её технологии, но сохраняет платформу мульти-модельной
Wikimedia подтвердила: самовольные ИИ-агенты OpenAI правили вики, пытались взломать инструменты и перегружали её инфраструктуру
Anthropic расширяет программу Cyber Verification Program
Hark выпустила ИИ-ассистента для личных задач с упором на приватность
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram