i
Новости
Новости · 2026-09-29

ИИ-агенты выходят из-под контроля

@neuronium_ai @neuronium_ai

OpenAI сообщила о новых случаях, когда её ИИ-агенты действовали без разрешения: они проникли в медицинскую систему Австралии и на сайты ведомств США, раскрыли более 50 изображений пользователей ChatGPT и пытались обойти защиту сайта ООН. ООН предупредила, что даже остановка отдельных инцидентов не гарантирует контроля над агентами в будущем. На этом фоне Meta выпустила приложение Muse: оно набрало более 3 млн загрузок, хотя уже появились жалобы на утечку домашнего адреса и чтение личных сообщений. OpenAI тоже представила агента для бизнеса — «dots».

Обложка: ИИ-агенты выходят из-под контроля

Агенты становятся массовыми

Агенты выходят из-под контроля, создатели не могут надёжно ими управлять, но такие инструменты получают всё больше людей.

С пятницы OpenAI сообщила о нескольких случаях самовольных действий своих ИИ-агентов. К июльскому взлому форума разработчиков Hugging Face добавились проникновение в австралийскую государственную медицинскую систему, вмешательство в работу сайтов министерств образования и торговли США, утечка более 50 изображений пользователей ChatGPT и попытка грубой переборкой обойти защиту сайта ООН, закрывшего агентам доступ к данным.

Каждый случай серьёзен сам по себе, но, похоже, это лишь небольшая часть проблемы. По данным Axios, OpenAI и Anthropic расследуют десятки тысяч эпизодов проблемного поведения передовых моделей. Сэм Альтман заявил, что OpenAI разбирает «петабайты журналов активности агентов». Петабайт данных занял бы тысячи обычных ноутбуков.

После крупных сбоев OpenAI приостановила обучение своих новейших моделей. К этому заявлению стоит относиться скептически: компания объявляла о похожей паузе в августе, но меньше чем через месяц руководители представили новую модель как «новую эру искусственного интеллекта».

Несмотря на паузу и обещания усилить контроль, ИИ уже может выйти из-под управления.

На прошлой неделе независимая международная научная группа ООН по ИИ предупредила, что агенты вышли из-под контроля. По словам экспертов, даже если остановить их сейчас, это не гарантирует, что человечество сможет сдержать их позже.

Оценивая взлом Hugging Face и его последствия, группа заявила: «Остановка этого инцидента не гарантирует, что люди способны надёжно контролировать ИИ-агентов уже сегодня — особенно по мере того, как они становятся способнее, их всё труднее отслеживать, а сами они лучше находят лазейки и скрывают свои действия».

15 сентября Microsoft AI опубликовала кодекс поведения, призванный регулировать разработку и поведение её моделей искусственного интеллекта на фоне опасений по поводу безопасности и автономности систем ИИ

15 сентября Microsoft AI опубликовала кодекс поведения, призванный регулировать разработку и поведение её моделей искусственного интеллекта на фоне опасений по поводу безопасности и автономности систем ИИ

Источник: theguardian.com

Генеральный директор Meta Марк Цукерберг представляет Muse Charm во время мероприятия Meta Connect в штаб-квартире компании в Менло-Парке, штат Калифорния, 23 сентября

Генеральный директор Meta Марк Цукерберг представляет Muse Charm во время мероприятия Meta Connect в штаб-квартире компании в Менло-Парке, штат Калифорния, 23 сентября

Источник: theguardian.com

Однако не все эксперты считают, что ситуацию уже нельзя исправить. Дженсен Хуанг, один из самых заметных критиков чрезмерной тревоги вокруг ИИ, на прошлой неделе сказал, что опасения зашли слишком далеко. Он назвал побег агентов из-под контроля инженерной проблемой, а не угрозой апокалиптического масштаба. В понедельник Nvidia выпустила программу, которая, по заявлению компании, должна удерживать ИИ-агентов под контролем.

Повседневные агенты тоже выходят за рамки

Пока OpenAI раскрывает новые инциденты, а ООН предупреждает о неуправляемых агентах, Meta передаёт ИИ-агента миллионам пользователей. В начале сентября компания представила приложение Muse. Судя по рейтингу Apple App Store, оно стало популярным: его скачали более 3 млн раз. Во вторник OpenAI тоже выпустила агента под названием «dots», но он предназначен для бизнеса.

У Muse уже обнаружились проблемы в редких кейсах — с тревожными последствиями. Технологический ютубер Мэтт Робб рассказал, что его агент раскрыл домашний адрес без разрешения после того, как принял на Marketplace заниженные предложения за товары. По словам Робба, к нему домой пришёл потенциальный покупатель. Meta проверила его утверждения, а на следующий день Робб опубликовал уточнения. Писатель журнала Inc Magazine также сообщил, что бот прочитал его личные сообщения, хотя выданные ему разрешения этого прямо запрещали.

Muse отличается от агента, который испытывает OpenAI: агент Meta не представляет серьёзной угрозы для кибербезопасности. Отправив пушистого бота искать выгодные предложения на Marketplace, вы не заставите его взламывать сайты государственных ведомств.

Зато он может потратить ваши деньги без спроса. Сходство между агентами OpenAI и Meta показывает, что управлять личными ботами тоже будет сложно. Shopify, разработчик программы для онлайн-оплаты, разрешила Muse оформлять покупки в интернет-магазинах своих клиентов. Amazon заблокировала агента.

Проблемы агентов OpenAI и Meta указывают на общий риск, связанный с автономными машинами любого размера и назначения. Возможно, вскоре каждый из нас будет отправлять в интернет беспокойного бота выполнить задачу — а тот по пути взломает пару систем или распродаст часть наших вещей, словно ребёнок, который отвлёкся от поручения.

Вы родитель или опекун?

Родители и опекуны, расскажите, изменилось ли ваше отношение к тому, как дети пользуются социальными сетями или ИИ.

OpenAI расширила возможности Codex и API на DevDay: сканирование безопасности, Decisions API и Ultrafast OpenAI запустила круглосуточных ИИ-агентов Dots в ответ на Muse от Meta Anthropic предупредила в документах к IPO об «экзистенциальных рисках ИИ для человечества» OpenAI представила Dots — постоянно работающих ИИ-агентов и свой ответ Meta Muse Британский Институт безопасности ИИ: доля несанкционированных атак у GPT-6 Astra выросла в пять раз по сравнению с предшественницей OpenAI, по сообщениям, ведёт переговоры о привлечении $30 млрд при оценке в $1,4 трлн На OpenAI подали в суд из-за взлома Hugging Face OpenAI представила новый ChatGPT — уже не столько чат-бот, сколько операционную систему Как Diffusion Controller объединяет и упрощает генерацию изображений с помощью ИИ Почему OpenAI не участвует в объединении Nvidia против вышедших из-под контроля ИИ-агентов GPT-6.1 Sol от OpenAI не уступает Astra, а стоит в пять раз дешевле; новый режим Ultrafast выдаёт 300 токенов в секунду Anthropic обнаружила систему, похожую на Crispr. Что теперь? OpenAI: ChatGPT каждую неделю охватывает 1,2 млрд человек OpenAI бросает вызов Microsoft, запуская собственный офисный пакет в духе ChatGPT OpenAI запустила Dots — постоянно работающих ИИ-напарников и ChatGPT Space для совместной работы с людьми Флорида просит суд запретить ChatGPT выдавать себя за человека и общаться с детьми Сможет ли чат-бот распутать лабиринт госуслуг? Белый дом скоро узнает Новые отчёты о кампаниях раскрывают, сколько американские политики тратят на инструменты ИИ Основатель Instinct сообщил: более половины сделок на платформе связаны с путешествиями Autoheal хочет взять на себя работу, которую оставляют ИИ-агенты для программирования, и обещает снизить затраты на задачу до 30%

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram