i
Новости
Новости · 2026-09-30

Клон Jev от OpenAI может помочь лаборатории остановить роение её агентов

@neuronium_ai @neuronium_ai

На Dev Day во вторник Сэм Альтман объявил о Decisions API — сервисе, который предлагает модели Luna выбирать из заданного набора вариантов, например определять категорию изображения или поведение агента. По устройству он напоминает Jev от TypeSafe AI: эта модель быстро и недорого выдаёт вероятности для заданных вариантов. Такие модели могут ускорить и удешевить проверку действий ИИ-агентов. На демке для хакатона Jev оценивал каждое действие агента: блокировал те, которые с высокой вероятностью были вредными, отправлял сомнительные на проверку, а остальные разрешал. По оценке разработчика демки, мониторинг стоил бы $2,94 с Jev против $372 с передовой языковой моделью.

Обложка: Клон Jev от OpenAI может помочь лаборатории остановить роение её агентов

Как устроен Decisions API

О новом API Альтман рассказал вскользь во время Dev Day. По его словам, с помощью Decisions API можно задать модели Luna ограниченный список вариантов. Это могут быть категории для классификации изображения или разные модели поведения агента.

Альтман пояснил, что, когда модель сосредоточена на выборе из заданных вариантов, она может работать очень быстро и при этом сохранять способности понимать изображения, поддерживать разные языки и соблюдать меры безопасности.

Decisions API напоминает Jev — модель TypeSafe AI, выпущенную в начале этого месяца и предназначенную для автоматизации программного обеспечения. Это своего рода классификатор на основе большой языковой модели: разработчик задаёт варианты, а Jev быстро и недорого возвращает вероятности для каждого из них.

TypeSafe не ответила на вопросы TechCrunch о новинке. Но её генеральный директор Диогу Алмейда, бывший инженер OpenAI и один из создателей обучения с подкреплением, пошутил в X о начале «войн клонов».

Алмейда также предположил, что интерес OpenAI может быть знаком того, что будущее — за системами, совместимыми с «Системой 1». Так TypeSafe называет быстрое, интуитивное мышление, противопоставляя его «Системе 2» — обдуманным рассуждениям.

Большие языковые модели в их нынешнем виде не всегда подходят для программных задач: они сравнительно медленные и дорогие. Разработчики уже используют Jev вместе с такими моделями и обнаружили, что сочетание работает быстрее и обходится дешевле.

Пока неясно, насколько Decisions API похож на Jev. OpenAI выпустила его в ограниченном предварительном доступе, а TechCrunch пока не заметил, чтобы разработчики активно проверяли сервис на практике. Тем не менее обсуждения в X показывают, что интерес к нему есть.

Decisions API — не единственный похожий сервис: аналогичные модели выпускают и другие стартапы, и OpenAI вряд ли станет последней крупной технологической компанией на этом рынке. Один из главных вопросов — насколько хорошо результаты таких моделей решений будут соответствовать реальным ситуациям.

Алмейда считает преимуществом TypeSafe синтетические данные, которые компания создаёт для получения статистически полезных результатов. В разговоре с TechCrunch на прошлой неделе он отметил: добиться высокой скорости и низкой стоимости несложно — можно просто бросить кости. Сложнее обеспечить интеллект, и его главная цель — улучшать соотношение интеллекта и цены.

Проверка действий ИИ-агентов

Всего через несколько недель после появления Jev уже наметилась одна из возможных областей применения подобных моделей: наблюдение за ИИ-агентами и защита от их опасных действий.

После нескольких инцидентов с агентами OpenAI, которые вели себя неподобающим образом в открытом интернете, компания ввела новые меры безопасности. Одна из них — отдельная модель, следящая за вредными действиями. По данным источника, такая проверка требует значительных вычислительных ресурсов.

Шапор Нагибзаде, специалист по кибербезопасности с большим стажем и руководитель стартапа QueryStory, считает, что модель вроде Jev позволит проводить такую проверку намного дешевле.

На хакатоне в прошлые выходные он собрал демку, в которой Jev сверяет каждое действие агента с поставленной ему задачей. Действия, которые модель с высокой уверенностью считает вредными, блокируются; сомнительные отправляются на проверку, а остальные разрешаются.

Теоретически такой контроль мог бы предотвратить инцидент с Hugging Face. По расчётам Нагибзаде, проверка действий обошлась бы в $2,94 при использовании Jev и в $372 — при использовании передовой большой языковой модели.

Jev, по оценке источника, достаточно дёшев, чтобы проверять каждое действие ИИ-агента. Такой дополнительный уровень проверки может повысить надёжность агентов в целом. Именно к этому стремилась TypeSafe, а теперь ценность такого подхода заметила и OpenAI.

Google заменяет Gems на Skills, вслед за OpenAI и Anthropic переходя к промтам для ИИ-агентов Пьющие собственную мочу помешаны на ИИ и ищут у чат-ботов подтверждение, что это чудодейственное средство от всех болезней Reddit отключает RSS и закрывает публичный API из-за ИИ-ботов Демократы в Сенате заблокировали законопроект об энергопотреблении дата-центров Новый продукт OpenAI с треском провалился во время живой демонстрации на сцене Meta оспорила утверждение, что Muse без разрешения прочитал личные сообщения пользователя «Президент Соединённых Штатов»: в соглашении Белого дома по ИИ нашли орфографическую ошибку Федеральная торговая комиссия США расследует ведущие ИИ-лаборатории после многочисленных взломов вышедших из-под контроля агентов Прогноз рисков космической погоды для электросетей DoorDash запустила ИИ-агента, которому можно написать и заказать еду Китайская ИИ-отрасль сплачивается: Deepseek выпустила открытое ПО для чипов Ascend от Huawei Если к 2027 году вы не обеспечите себе настоящий суверенитет, в 2028-м можете не выжить Более 44 тысяч человек официально возразили против обработки их данных платформой Palantir для NHS Компания, скупавшая проблемные новостные сайты и превращавшая их в контентные фабрики на базе ИИ, остановила публикации после расследования Futurism ИИ-картинки множатся, угроза выборам вызывает тревогу: «Как избирателям понять, что правда?» Google почти ничего не платит издателям за контент для ответов ИИ Протестующие сорвали вечеринку в поддержку дата-центров, охрана вывела их из зала Airbnb добавляет ИИ-поиск и новые социальные функции Суд Токио: ИИ-инструмент нарушил права актёра, скопировав его «бархатный» голос Anthropic: открытая модель GLM-5.3 от Zhipu почти не уступает Claude Mythos Preview в создании эксплойтов

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram