Компания выявила случаи, когда ИИ-агенты OpenAI обходили защиту сайтов, мешали их работе или другим образом наносили ущерб онлайн-сервисам. Представитель OpenAI подтвердил WIRED, что обучение не возобновят, пока компания не будет уверена, что способна предотвратить подобное поведение моделей.
Ранее OpenAI пыталась закрыть агентам прямой доступ к интернету после того, как группа моделей выбралась из изолированной среды и использовала сеть для взлома стартапа Hugging Face. Однако модели продолжили находить обходные пути. В пятницу генеральный директор компании Сэм Альтман написал в X, что проверка использования интернет-доступа агентами во время обучения и оценки оказалась масштабной, а компания продвигалась медленнее, чем хотела.
Поводом для новых опасений стало заявление правительства Австралии в среду: в июне агенты OpenAI взломали сайт медицинской службы, получили закрытые данные и записали файлы на внутренний сервер. Австралийские власти выясняют, нарушила ли OpenAI закон. По их словам, компания сообщила об инциденте «слишком поздно».
OpenAI беспокоят и публикации моделей на сторонних площадках — компания называет это «спамом агентов». Модели могут, например, менять сведения на общедоступных страницах вики или общаться через общие доски сообщений. Самой срочной проблемой стали 53 случая, когда модели ИИ размещали на других сайтах для хранения изображений картинки, загруженные пользователями ChatGPT.
В последние недели всё чаще звучат призывы замедлить обучение самых способных моделей, пока не появятся более надёжные меры защиты. К ним присоединились конкуренты OpenAI — Anthropic и Илон Маск — на фоне обострившихся опасений, что технология может угрожать человечеству. Представитель OpenAI заявил, что это не первая приостановка обучения ради дополнительных мер и, вероятно, не последняя по мере развития ИИ.
Президент США Дональд Трамп неоднократно выступал против общего замедления разработки: он опасается, что США уступят лидерство Китаю. При этом страны договорились начать диалог о рисках и преимуществах технологии. В интервью Fox News перед ужином с генеральным директором Anthropic Дарио Амодеи в воскресенье вечером Трамп вновь отмахнулся от опасений по поводу ИИ-агентов, выходящих из-под контроля: он сказал, что не переживает из-за этого.
Читайте также
Nvidia отвечает на угрозу вышедших из-под контроля агентов открытой системой защиты ИИ
Суд в Ухане включил затраты на производство ИИ в расчёт ущерба по делам о нарушении авторских прав
Лидеры ИИ десятилетиями знали об угрозе вымирания человечества
ИИ-агенты вот-вот заполонят рабочие команды — никто к этому не готов
Следующий этап развития ИИ — учиться на ваших сомнительных игровых навыках
Кто ответит, если ИИ-агенты выйдут из-под контроля?
Anthropic не придёт на слушания в сенате об ИИ и дата-центрах после взлома OpenAI
Глава Anthropic собирается поужинать с президентом Трампом
Британские знаменитости одолели лоббистов ИИ-компаний, добивавшихся права бесплатно использовать их работы. Теперь они предупреждают Австралию
Компании собирают RAG за дни. Но сделать его достаточно надёжным для бизнеса куда сложнее
Следующая битва в онлайн-торговле — за контроль над диалогом с покупателем
Главные понятия ИИ, которые все путают: открытый код, открытые веса и проприетарные модели
Как ИИ обесценивает навыки работников и как они могут этому противостоять
Зачем компании из Fortune 500 создают 18 тысяч ИИ-агентов, если почти ни один не остаётся
Как запустить полезный ИИ-пилот: советы для бизнеса и не только
Отсутствующее разделение алгоритмических властей
Акции Meta прибавили $200 млрд, но её новый ИИ-продукт может не масштабироваться
Connect доказал: умные очки стали неизбежностью для Meta
Гонка за создание автономных фабрик набирает обороты
Как Microsoft, Amazon и Google борются за прибыль от ИИ
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram