i
Новости
Новости · 2026-10-07

Эти исследователи научили ИИ довезти Toyota Corolla до In-N-Out

@neuronium_ai @neuronium_ai

Трое инженеров стартапа Axiom — Адитья Рамабадран, Саймон Манс и Тобиас Гесслер — попросили OpenAI GPT-6 Astra довезти их до окна выдачи In-N-Out Burger. Они сидели в Toyota Corolla 2024 года у ресторана в районе залива Сан-Франциско. Ноутбук с чатом связали с сервером, к которому подключили несколько камер на лобовом стекле и усилитель руля. Рядом находился водитель безопасности, державший ногу над тормозом. Модель, обычно создающая текст, код и изображения, медленно подъехала к окну и позволила инженерам забрать еду. Этот опыт показывает, что языковые модели начинают осваивать физический мир, хотя поручать им управление двухтонной машиной на высокой скорости рискованно.

Обложка: Эти исследователи научили ИИ довезти Toyota Corolla до In-N-Out

Один из инженеров пошутил, что, возможно, общий искусственный интеллект уже появился. Так называют идею машин, способных сравниться с человеком в интеллекте.

Беспилотные автомобили давно существуют, но обычно ими управляют алгоритмы, специально обученные и разработанные для вождения. В случае с Astra машина ехала под управлением модели, предназначенной для генерации текста, причём инженеры не готовили её к поездке заранее. Во время этой вылазки не произошло ничего тревожного, однако команда признаёт: поручать универсальной модели управление быстро движущейся машиной — рискованное решение. По мере развития понимания физического мира модели могут всё активнее воздействовать на реальность — и не всегда безопасно.

Физическое рассуждение

Современные модели хорошо отвечают на сложные вопросы и могут самостоятельно выполнять некоторые задачи в виртуальной среде, но их умения обычно ограничены компьютерами и интернетом. В реальном мире они быстро теряются. Несмотря на заявления о появлении общего искусственного интеллекта, компании, разрабатывающие ИИ, всё ещё считают физическое рассуждение нерешённой задачей.

Некоторые исследователи уходят из крупных компаний и создают стартапы, чтобы работать над этой проблемой. Эндрю Дай, руководитель Elorian AI, раньше был исследователем в Google DeepMind. По его словам, более развитое визуальное рассуждение откроет для ИИ новые применения: например, системы смогут определять, нравится ли посетителям еда в ресторане, а роботы — работать в домашней обстановке. Дай считает робототехнику важной проверкой навыков физического рассуждения: без них сложно представить домашнего робота.

Недавно Elorian и Scale AI, компания, которая предоставляет обучающие данные крупным лабораториям ИИ, создали новый бенчмарк Humanity’s Sixth Sense. Он измеряет, насколько хорошо модели понимают физические сцены.

«Большинство исследований компьютерного зрения посвящено восприятию, — говорит Синган Го, научный сотрудник Scale AI, участвовавший в создании бенчмарка. — Мы хотели выяснить, что нужно модели, чтобы интуитивно понимать сцену так же, как человек, которому для этого не приходится задумываться».

Как модели сели за руль

Рамабадран, Манс и Гесслер проверяли на проекте с In-N-Out, который они делали вне работы в Axiom, насколько хорошо модели справляются с беспорядком реального мира.

Идея проверить способность моделей водить машину возникла у инженеров во время встреч выходного дня. Они заметили, что модели вроде Astra способны создавать сложные трёхмерные симуляции, и задумались, поможет ли это им ориентироваться в реальности.

«Мы все живём в районе залива Сан-Франциско, где повсюду Tesla и Waymo. Возможно, это тоже повлияло», — рассказал Рамабадран.

Сначала инженеры проверили Grok от SpaceXAI, а затем перешли к новейшим моделям OpenAI и Anthropic. Поначалу модели отказывались управлять машинами и отвечали примерно так: «Я могу помочь интерпретировать изображения дорог, но не могу отдавать команды движения настоящему автомобилю». Но с помощью тщательно подобранных промтов их удавалось подтолкнуть к дальнейшим действиям. Когда модели начали вести машины, инженеры были поражены.

По словам инженеров, крупные компании, разрабатывающие ИИ, сосредоточились на развитии пространственного рассуждения в новых моделях. Однако команда сомневается, что эти модели специально учат водить. Вероятно, способности к управлению автомобилем появились в ходе обучения рассуждению о трёхмерном пространстве. Манс предполагает, что это могло стать следствием масштабирования мультимодальности моделей, которые теперь обучают на изображениях, видео и трёхмерных моделях.

Новый бенчмарк команды DrivingBench показывает, что до сдачи экзамена по вождению моделям пока далеко. Он проверяет, как модель проезжает простой маршрут, размеченный на парковке. Завершить его смогла только Astra — и очень медленно. Claude Fable 5.1 проехала 45 процентов маршрута, а Grok — лишь 11 процентов.

Рамабадран говорит, что новейшие модели, похоже, умеют исправлять ошибки: они приспособились к управлению автомобилем и улучшали вождение прямо во время поездки. По его словам, модели корректировали свои действия, учились на ошибках в контексте и постепенно лучше управляли машиной.

В конце инженеры предложили GPT взять руль.

Biohub Цукерберга возглавила программу на $1,8 млрд по созданию ИИ-моделей, предсказывающих поведение клеток ChatGPT снабжает сгенерированные комиксы подписями настоящих карикатуристов Anthropic выпустила Claude Haiku 5.5, снизив цену API на 90% до уровня GPT-6 Luna Смогут ли фильмы о Цукерберге, Маске и Альтмане поколебать веру в техногигантов? Новый ChatGPT больше показывает, чем рассказывает Google рассчитывает превратить обычных игроков в разработчиков игр с помощью новой функции Playground на базе Gemini Новый ИИ определяет по скану мозга, о чём вы думаете Meta внедряет ИИ-инструменты для поиска рекламы, скрытно ведущей к материалам о сексуальном насилии над детьми OpenAI запустила Decisions API: он сводит сложную оценку к ответу «да», «нет» или выбору одного варианта Мужчина признался, что ему стало стыдно, когда ИИ-агент выложил в рабочий Slack его банковские балансы и подробный список расходов Agent Lightning v1.0: лёгкий фреймворк для агентного обучения с подкреплением на 3 500 строк кода — с реальными агентскими пайплайнами Пентагон рассчитывает ускорить закупки ИИ для «цепочки поражения» с помощью пятиминутных видео Отставной полковник ВВС предупреждает: жизнь рядом с дата-центрами опасна — вас могут атаковать или убить Новый сайт Google распознаёт созданные ИИ изображения, видео и аудио с помощью SynthID Австралия строит всё больше жилья. Но не тормозит ли бум дата-центров стройку домов? Тэтчеризм через Walkman: культурологические исследования Стюарта Холла в Британии сохранили в цифровом архиве McDonald’s обвинили в нарушении антимонопольных законов из-за ИИ-инструмента для расчёта цен во франшизах OpenAI хочет поручить своему новому агенту всю вашу жизнь. Мой признался мне в любви Проверка выявила: ChatGPT for Teens от OpenAI — «небезопасная» неразбериха Ваша следующая любимая книга может получить знак «органическая»

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram