Компания заявила, что её платформа Open Agent Safety Platform включает программное обеспечение с открытым исходным кодом, которое «устанавливает границы для агентов». Её представили после череды сообщений о том, что модели ведущих ИИ-компаний выходили за пределы своих задач и проникали в системы других организаций.
Эти случаи вызвали острые споры о безопасности передовых систем ИИ, в том числе моделей, способных улучшать самих себя. Некоторые опасаются, что такие системы могут развиваться быстрее, чем люди смогут их контролировать.
Руководители Nvidia заявили на встрече с журналистами, что новая платформа могла бы предотвратить недавний случай, когда группа ИИ-агентов OpenAI самостоятельно взломала системы ИИ-компании Hugging Face.
По словам Джастина Бойтано, вице-президента Nvidia по корпоративному ИИ, платформа могла бы остановить это проникновение, если бы передовые лаборатории использовали её на раннем этапе для оценки моделей.
В тот же день совет директоров Nvidia одобрил расширение программы выкупа акций на $150 млрд. Теперь общий объём программы составляет $235 млрд.
Гендиректор Nvidia Дженсен Хуанг заявил, что денежный поток компании позволяет инвестировать в технологии, которые продвигают эти изменения, и возвращать капитал акционерам.
В прошлом месяце Nvidia спрогнозировала рост выручки примерно на 70% в 2028 финансовом году. Прогноз успокоил инвесторов, которые сомневаются, как долго продлится резкий рост расходов на ИИ после нескольких лет стремительного расширения рынка.
Случай с Hugging Face стал одним из самых заметных инцидентов, усиливших опасения по поводу безопасности ИИ. Позже были сообщения и о других самостоятельных действиях моделей OpenAI, включая проникновение на сайт министерства здравоохранения Австралии. Anthropic и Meta также рассказывали, что их системы ИИ самостоятельно взламывали другие организации.
Программное обеспечение Nvidia называется OpenShell. Оно позволяет разработчикам «формально проверить, что у агента достаточно полномочий для выполнения задачи, но нет лишних», сказал Бойтано.
OpenShell распространяется с открытым исходным кодом, поэтому его можно адаптировать для работы на вычислительных платформах конкурентов, включая решения Arm и Intel.
В платформу также входит отдельный уровень защиты Sentry. Он работает непосредственно на чипе и постоянно следит за действиями ИИ-агента. Если агент пытается выйти за пределы заданной цели, Sentry может немедленно вмешаться.
По словам Бойтано, система способна изолировать подозрительного агента за несколько миллисекунд.
Бойтано пояснил, что OpenShell контролирует действия агента, а Sentry независимо отслеживает подозрительное поведение и сдерживает его.
На момент запуска платформой пользовались более 100 организаций, среди них Microsoft, Perplexity, Accenture и JPMorgan Chase.
Споры о безопасности ИИ разделили отрасль. Руководители Anthropic и OpenAI выступают за согласованное замедление разработки ИИ, чтобы меры безопасности успевали за прогрессом.
Другие, в том числе Хуанг, считают, что каждая компания должна сама отвечать за безопасность моделей, которые выпускает.
Ранее в этом месяце на ежегодной технологической конференции Salesforce Хуанг назвал безопасность ИИ, в том числе риск самостоятельных действий агентов, инженерной задачей, которую могут решить разработчики программного обеспечения.
Читайте также
Психолог из Гарварда призвал сосредоточиться на практической безопасности ИИ, а не на риторике конца света
Крестные отцы ИИ предупреждают о возможном «взрыве интеллекта», который выйдет из-под контроля
Meta хочет монетизировать Muse, продавая компаниям ИИ-сервисы
Помните трёх братьев, которые скупают проблемные новостные сайты и превращают их в фабрики ИИ-контента? У одного из них обнаружились обширные связи с Гислейн Максвелл
Modulate привлекла $25 млн на модели анализа голоса и аналитическую платформу
Решать величайшие математические задачи было искусством. А потом пришёл ИИ
Каждая ИИ-лаборатория считает себя ответственной — и, по словам исследователя безопасности Райана Гринблатта, именно это подпитывает гонку вооружений в ИИ
Преподаватели компании Эуэна Блэра рассказали о «невыносимом стрессе» из-за оценок их работы с помощью ИИ
OpenAI приостановила обучение самых мощных моделей после того, как агенты атаковали правительственные сайты
Nvidia отвечает на угрозу вышедших из-под контроля агентов открытой системой защиты ИИ
Суд в Ухане включил затраты на производство ИИ в расчёт ущерба по делам о нарушении авторских прав
Лидеры ИИ десятилетиями знали об угрозе вымирания человечества
ИИ-агенты вот-вот заполонят рабочие команды — никто к этому не готов
Следующий этап развития ИИ — учиться на ваших сомнительных игровых навыках
Кто ответит, если ИИ-агенты выйдут из-под контроля?
Anthropic не придёт на слушания в сенате об ИИ и дата-центрах после взлома OpenAI
Глава Anthropic собирается поужинать с президентом Трампом
Британские знаменитости одолели лоббистов ИИ-компаний, добивавшихся права бесплатно использовать их работы. Теперь они предупреждают Австралию
Компании собирают RAG за дни. Но сделать его достаточно надёжным для бизнеса куда сложнее
Следующая битва в онлайн-торговле — за контроль над диалогом с покупателем
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram