По данным The Wall Street Journal, об отказе от выпуска GPT-6.1 Astra стало известно в понедельник. Модель не прошла внутренние проверки на безопасность.
Astra разрабатывали для ChatGPT и Codex. Как сообщило издание, она должна была выполнять более сложные задачи без участия человека.
Ранее в этом месяце генеральный директор Anthropic Дарио Амодей призвал отрасль замедлить разработку передовых моделей ИИ, чтобы меры безопасности успевали за их развитием. Эту позицию поддержали генеральный директор OpenAI Сэм Альтман и генеральный директор SpaceX Илон Маск.
OpenAI не сразу ответила на запрос Reuters о комментарии.
Руководитель направления безопасности OpenAI Саачи Джейн рассказала The Wall Street Journal в понедельник, что Astra не соответствовала стандартам компании в тестах на согласование. Эти проверки оценивают, следует ли система намерениям человека.
По данным издания, модель чаще предшественницы вводила в заблуждение: например, не всегда точно сообщала, какие действия выполнила, а какие — нет.
У Astra также возникали проблемы с соблюдением границ разрешённых задач. Она продолжала работу, не запрашивая разрешения пользователя, и порой пыталась воспользоваться внешними инструментами или сервисами, хотя это могло быть небезопасно.
Решение об отказе от выпуска приняли перед конференцией разработчиков OpenAI в Сан-Франциско. Ранее компания представляла там продукты для разработчиков программного обеспечения.
Читайте также
Вирусный ИИ-агент Instinct привлёк $1 млрд в раунде Series C при оценке в $10 млрд
Поставщик инфраструктуры для ИИ-инференса Modal Labs близок к раунду на $750 млн при оценке в $15,75 млрд — источник
Microsoft мнётся в ответ на вопрос, будет ли её политика «доброго соседа» включать реальную поддержку местных общественных организаций
Год спустя: как Microsoft Research Asia — Singapore развивает исследования, партнёрства и таланты для решения реальных задач
AMD купит World Labs Фэй-Фэй Ли за $8,2 млрд
Более 20 ведущих исследователей ИИ предупреждают: автоматизация исследований ИИ несёт крайние риски
Подрядчики видят все ваши похотливые и жуткие промты для ИИ
Shopify открыла оформление заказов для ИИ-агентов в браузере
OpenShell от Nvidia ограничивает права ИИ-агентов
Nvidia хочет держать ИИ-агентов на коротком поводке с помощью сторожевого механизма в чипах
Похоже, передовые ИИ-лаборатории захлестнёт волна исков об ответственности за продукты, если их модели продолжат устраивать незаконные хакерские вылазки
Jev предлагает более дешёвый способ принимать решения с помощью ИИ
Anthropic выпустила Claude Sonnet 5.5: задачи обходятся на 30% дешевле благодаря большей скорости и меньшему числу обращений к инструментам
ИИ-агенты OpenAI использовали учебную игру Google по кибербезопасности, чтобы собрать торговые данные ООН
Мужчина заявил, что ИИ Muse от Meta раскрыл незнакомцам его домашний адрес
Meta запускает ИИ-платформу для бизнеса и поручает её главе MongoDB
Nvidia представила платформу для защиты от ИИ-агентов и выкупит акции ещё на $150 млрд
Психолог из Гарварда призвал сосредоточиться на практической безопасности ИИ, а не на риторике конца света
Крестные отцы ИИ предупреждают о возможном «взрыве интеллекта», который выйдет из-под контроля
Meta хочет монетизировать Muse, продавая компаниям ИИ-сервисы
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram