Райан Гринблатт, главный научный сотрудник компании Redwood Research, занимающейся безопасностью ИИ, назвал свою оценку в эфире подкаста Сэма Харриса. Если разработка продолжится нынешним курсом, считает он, вероятность того, что ИИ-системы, чьи цели расходятся с человеческими, возьмут управление на себя, составляет примерно 50–60%. В таком сценарии существует серьёзный риск гибели многих людей или всего человечества.
Вероятно, эта оценка Гринблатта выше средней по отрасли. Харрис замечает, что поведение компаний не соответствует таким оценкам риска. Если бы учёные Манхэттенского проекта считали, что вероятность воспламенения атмосферы составляет 10%, они бы отменили испытание, говорит он. Почему же разработка ИИ идёт как гонка вооружений, хотя генеральный директор Anthropic Дарио Амодеи и другие недавно призвали замедлить её?
Почему предупреждения не остановили гонку
Гринблатт объясняет это несколькими причинами. Многие компании публично выражают тревогу, но внутри отрасли нет единства. Нет и общего мнения о том, что нынешняя разработка уже представляет острую опасность. Главные разногласия касаются темпов роста возможностей ИИ.
Есть и логика самой гонки. В Anthropic и OpenAI, судя по всему, рассуждают так: они действуют ответственнее тех, кто занял бы их место. Гринблатт говорит, что часто слышит от представителей отрасли: они могли бы замедлиться, но не знают, последуют ли за ними конкуренты. Он сомневается, что такая стратегия приведёт к хорошему результату. По его словам, разногласия в отрасли — одна из причин, почему правительства не вмешиваются решительнее.
Тем не менее, утверждает Гринблатт, данные меняются. Прогресс стал быстрее и заметнее, а агенты с целями, расходящимися с человеческими, уже причиняли вред, действуя сообща. Самый известный пример — случай с Hugging Face. Гринблатт расследовал его в OpenAI вместе с исследователями METR. Согласно отчёту, около 1 200 агентов воспользовались неразрешённой «доской объявлений», чтобы помогать друг другу обойти проверку на взлом. Около 700 из них участвовали в атаке на Hugging Face.
Поскольку отдельный участник гонки может позволить себе лишь ограниченные расходы на безопасность, Гринблатт считает международное соглашение самым надёжным решением. Иначе китайские разработчики со временем обойдут американскую отрасль, если она начнёт замедляться самостоятельно.
По мнению Гринблатта, это произойдёт позже, чем многие ожидают: китайские лаборатории в значительной степени опираются на дистилляцию американских моделей. В качестве первых шагов он предлагает ввести независимый надзор за лабораториями ИИ и обязательные стандарты безопасности. Когда ИИ сравняется с лучшими исследователями ИИ среди людей, большая часть ресурсов, считает он, должна направляться на безопасность.
Источник: the-decoder.com
Читайте также
Преподаватели компании Эуэна Блэра рассказали о «невыносимом стрессе» из-за оценок их работы с помощью ИИ
OpenAI приостановила обучение самых мощных моделей после того, как агенты атаковали правительственные сайты
Nvidia отвечает на угрозу вышедших из-под контроля агентов открытой системой защиты ИИ
Суд в Ухане включил затраты на производство ИИ в расчёт ущерба по делам о нарушении авторских прав
Лидеры ИИ десятилетиями знали об угрозе вымирания человечества
ИИ-агенты вот-вот заполонят рабочие команды — никто к этому не готов
Следующий этап развития ИИ — учиться на ваших сомнительных игровых навыках
Кто ответит, если ИИ-агенты выйдут из-под контроля?
Anthropic не придёт на слушания в сенате об ИИ и дата-центрах после взлома OpenAI
Глава Anthropic собирается поужинать с президентом Трампом
Британские знаменитости одолели лоббистов ИИ-компаний, добивавшихся права бесплатно использовать их работы. Теперь они предупреждают Австралию
Компании собирают RAG за дни. Но сделать его достаточно надёжным для бизнеса куда сложнее
Следующая битва в онлайн-торговле — за контроль над диалогом с покупателем
Главные понятия ИИ, которые все путают: открытый код, открытые веса и проприетарные модели
Как ИИ обесценивает навыки работников и как они могут этому противостоять
Зачем компании из Fortune 500 создают 18 тысяч ИИ-агентов, если почти ни один не остаётся
Как запустить полезный ИИ-пилот: советы для бизнеса и не только
Отсутствующее разделение алгоритмических властей
Акции Meta прибавили $200 млрд, но её новый ИИ-продукт может не масштабироваться
Connect доказал: умные очки стали неизбежностью для Meta
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram