Один из инженеров пошутил, что, возможно, общий искусственный интеллект уже появился. Так называют идею машин, способных сравниться с человеком в интеллекте.
Беспилотные автомобили давно существуют, но обычно ими управляют алгоритмы, специально обученные и разработанные для вождения. В случае с Astra машина ехала под управлением модели, предназначенной для генерации текста, причём инженеры не готовили её к поездке заранее. Во время этой вылазки не произошло ничего тревожного, однако команда признаёт: поручать универсальной модели управление быстро движущейся машиной — рискованное решение. По мере развития понимания физического мира модели могут всё активнее воздействовать на реальность — и не всегда безопасно.
Физическое рассуждение
Современные модели хорошо отвечают на сложные вопросы и могут самостоятельно выполнять некоторые задачи в виртуальной среде, но их умения обычно ограничены компьютерами и интернетом. В реальном мире они быстро теряются. Несмотря на заявления о появлении общего искусственного интеллекта, компании, разрабатывающие ИИ, всё ещё считают физическое рассуждение нерешённой задачей.
Некоторые исследователи уходят из крупных компаний и создают стартапы, чтобы работать над этой проблемой. Эндрю Дай, руководитель Elorian AI, раньше был исследователем в Google DeepMind. По его словам, более развитое визуальное рассуждение откроет для ИИ новые применения: например, системы смогут определять, нравится ли посетителям еда в ресторане, а роботы — работать в домашней обстановке. Дай считает робототехнику важной проверкой навыков физического рассуждения: без них сложно представить домашнего робота.
Недавно Elorian и Scale AI, компания, которая предоставляет обучающие данные крупным лабораториям ИИ, создали новый бенчмарк Humanity’s Sixth Sense. Он измеряет, насколько хорошо модели понимают физические сцены.
«Большинство исследований компьютерного зрения посвящено восприятию, — говорит Синган Го, научный сотрудник Scale AI, участвовавший в создании бенчмарка. — Мы хотели выяснить, что нужно модели, чтобы интуитивно понимать сцену так же, как человек, которому для этого не приходится задумываться».
Как модели сели за руль
Рамабадран, Манс и Гесслер проверяли на проекте с In-N-Out, который они делали вне работы в Axiom, насколько хорошо модели справляются с беспорядком реального мира.
Идея проверить способность моделей водить машину возникла у инженеров во время встреч выходного дня. Они заметили, что модели вроде Astra способны создавать сложные трёхмерные симуляции, и задумались, поможет ли это им ориентироваться в реальности.
«Мы все живём в районе залива Сан-Франциско, где повсюду Tesla и Waymo. Возможно, это тоже повлияло», — рассказал Рамабадран.
Сначала инженеры проверили Grok от SpaceXAI, а затем перешли к новейшим моделям OpenAI и Anthropic. Поначалу модели отказывались управлять машинами и отвечали примерно так: «Я могу помочь интерпретировать изображения дорог, но не могу отдавать команды движения настоящему автомобилю». Но с помощью тщательно подобранных промтов их удавалось подтолкнуть к дальнейшим действиям. Когда модели начали вести машины, инженеры были поражены.
По словам инженеров, крупные компании, разрабатывающие ИИ, сосредоточились на развитии пространственного рассуждения в новых моделях. Однако команда сомневается, что эти модели специально учат водить. Вероятно, способности к управлению автомобилем появились в ходе обучения рассуждению о трёхмерном пространстве. Манс предполагает, что это могло стать следствием масштабирования мультимодальности моделей, которые теперь обучают на изображениях, видео и трёхмерных моделях.
Новый бенчмарк команды DrivingBench показывает, что до сдачи экзамена по вождению моделям пока далеко. Он проверяет, как модель проезжает простой маршрут, размеченный на парковке. Завершить его смогла только Astra — и очень медленно. Claude Fable 5.1 проехала 45 процентов маршрута, а Grok — лишь 11 процентов.
Рамабадран говорит, что новейшие модели, похоже, умеют исправлять ошибки: они приспособились к управлению автомобилем и улучшали вождение прямо во время поездки. По его словам, модели корректировали свои действия, учились на ошибках в контексте и постепенно лучше управляли машиной.
В конце инженеры предложили GPT взять руль.
Читайте также
Biohub Цукерберга возглавила программу на $1,8 млрд по созданию ИИ-моделей, предсказывающих поведение клеток
ChatGPT снабжает сгенерированные комиксы подписями настоящих карикатуристов
Anthropic выпустила Claude Haiku 5.5, снизив цену API на 90% до уровня GPT-6 Luna
Смогут ли фильмы о Цукерберге, Маске и Альтмане поколебать веру в техногигантов?
Новый ChatGPT больше показывает, чем рассказывает
Google рассчитывает превратить обычных игроков в разработчиков игр с помощью новой функции Playground на базе Gemini
Новый ИИ определяет по скану мозга, о чём вы думаете
Meta внедряет ИИ-инструменты для поиска рекламы, скрытно ведущей к материалам о сексуальном насилии над детьми
OpenAI запустила Decisions API: он сводит сложную оценку к ответу «да», «нет» или выбору одного варианта
Мужчина признался, что ему стало стыдно, когда ИИ-агент выложил в рабочий Slack его банковские балансы и подробный список расходов
Agent Lightning v1.0: лёгкий фреймворк для агентного обучения с подкреплением на 3 500 строк кода — с реальными агентскими пайплайнами
Пентагон рассчитывает ускорить закупки ИИ для «цепочки поражения» с помощью пятиминутных видео
Отставной полковник ВВС предупреждает: жизнь рядом с дата-центрами опасна — вас могут атаковать или убить
Новый сайт Google распознаёт созданные ИИ изображения, видео и аудио с помощью SynthID
Австралия строит всё больше жилья. Но не тормозит ли бум дата-центров стройку домов?
Тэтчеризм через Walkman: культурологические исследования Стюарта Холла в Британии сохранили в цифровом архиве
McDonald’s обвинили в нарушении антимонопольных законов из-за ИИ-инструмента для расчёта цен во франшизах
OpenAI хочет поручить своему новому агенту всю вашу жизнь. Мой признался мне в любви
Проверка выявила: ChatGPT for Teens от OpenAI — «небезопасная» неразбериха
Ваша следующая любимая книга может получить знак «органическая»
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram