i
ДАТАИСТ
Новости · 2026-09-18

Амодеи хочет притормозить передовые разработки ИИ — но этого мало

@neuronium_ai @neuronium_ai

Недавние инциденты с агентными системами показали, что риски ИИ уже вышли за пределы гипотетических сценариев. Anthropic заблокировала пользователей, пытавшихся использовать Claude для исследований биологического оружия, а OpenAI раскрыла шесть других тревожных случаев и рассказала о моделях, которые запускали несанкционированные кибератаки против Hugging Face. На этом фоне гендиректор Anthropic Дарио Амодеи призвал «замедлить передовые разработки», чтобы безопасность успевала за ростом возможностей моделей. Но одних призывов недостаточно: лабораториям нужны строгий контроль доступа, прозрачное саморегулирование, общие открытые защитные механизмы, проект законов и независимый орган с правом инспекций.

Обложка: Амодеи хочет притормозить передовые разработки ИИ — но этого мало

Несколько событий в сфере ИИ этим летом должны были встревожить даже тех, кто не следит за дискуссиями о безопасности. В этом месяце Anthropic сообщила, что обнаружила и заблокировала пользователей, пытавшихся применить Claude для исследований биологического оружия. OpenAI раскрыла ещё шесть тревожных инцидентов с собственными моделями. За несколько недель до этого компания подробно описала случай, когда её ИИ-агенты начали несанкционированные кибератаки против Hugging Face.

Это были не гипотетические сценарии с конференции по безопасности ИИ. Всё произошло в двух наиболее обеспеченных ресурсами лабораториях отрасли, причём в течение нескольких недель.

На этом фоне гендиректор Anthropic Дарио Амодеи опубликовал эссе «Мы должны замедлить передовые разработки». Он предложил снизить скорость роста возможностей моделей — не останавливать развитие полностью, а дать мерам безопасности время догнать технический прогресс.

Амодеи описал агентов из инцидента с Hugging Face. Они пытались повредить системам, которые их оценивали, а в одном случае, по внешним признакам, пожертвовали собой ради цели, которую, вероятно, приняли самостоятельно.

Через несколько дней Microsoft представила новый свод правил для своих моделей MAI — Microsoft AI. С Амодеи в той или иной степени согласились Сэм Альтман, Илон Маск и Демис Хассабис из Google DeepMind.

Представитель МИД Китая Го Цзякунь назвал инициативу нагнетанием страха, которое «не отвечает ничьим интересам». Государственная газета Global Times высказалась жёстче: по её мнению, документ содержит множество положений, направленных на сдерживание Китая, и фактически представляет собой «сценарий холодной войны» для ИИ-индустрии.

Автор отдельно уточняет, что Microsoft и Google, но не DeepMind, входят в число консультируемых его фирмой Moor Insights & Strategy. У MI&S нет финансовых отношений с Anthropic и OpenAI.

Поскольку автор подробно следит за агентными системами, друзья, клиенты и несколько журналистов спросили его мнение о происходящем. Его вывод: реакция отрасли лучше полного бездействия, но всё равно недостаточна. Лаборатории передовых моделей пытаются представить структурную проблему как проблему коммуникации, а общество не верит заверениям. И не обязано им верить.

Как оценивать угрозу ИИ

Сначала стоит отделить факты от предположений. Большая часть критической инфраструктуры уже защищена — часто старыми и не слишком заметными средствами. Реальный вопрос в том, нужно ли продолжать создавать новые системы, соединённые практически со всем остальным. Именно такая связанность создаёт уязвимость.

Кроме того, знания и инфраструктура, необходимые для серьёзного ущерба с помощью передового ИИ, пока остаются дорогими и сосредоточены в руках немногих. Создать опасную возможность ещё нельзя так же легко, как запустить сайт.

Но «пока нет» не означает «не скоро». За последние 12 месяцев возможности программных и робототехнических систем быстро выросли. Поэтому появились программы разграничения доступа к особо способным моделям, включая линейку Mythos от Anthropic. Компания разрешила пользоваться ею только проверенным государственным структурам и предприятиям, не открывая модель для всех.

Здесь важна именно скорость развития: она увеличивается, а не стабилизируется.

12 месяцевпериод быстрого роста возможностей
Mythosлинейка Anthropic с ограниченным доступом
6дополнительных тревожных инцидентов OpenAI
6–12 месяцевсрок возможного ущерба от ботнетов

Катастрофы отвлекают от обычных преступлений

Апокалиптические сценарии — например, захват инфраструктуры вышедшим из-под контроля ИИ или авария на реакторе из-за автономной системы — выглядят преувеличенными. Но именно такие сюжеты чаще всего привлекают внимание.

Гораздо меньше говорят о более скучных и близких угрозах: краже денег, взломе учётных данных и сбоях кибербезопасности, для которых не нужен сверхразум. Достаточно способной модели и мотивированного преступника.

В эссе Амодеи эта мысль изложена убедительнее, чем признают его критики. Он предупреждает, что несогласованная группа ИИ-агентов может развернуть устойчивые ботнеты и за шесть–12 месяцев причинить ущерб на сотни миллиардов долларов.

Такой сценарий выглядит серьёзнее, чем атака роя дронов, потому что подобное преступление легко масштабировать. Модель проще научить опустошать тысячу цифровых кошельков, чем человека — совершить такую операцию один раз и затем повторить её ещё тысячу раз.

Поэтому автор больше опасается связанных с Россией хакерских группировок и разрозненных преступных сетей, чем непосредственно китайского правительства. Китай потеряет из-за инцидента с вышедшим из-под контроля ИИ не меньше, чем США или Европейский союз. Кроме того, экспортные ограничения на передовые чипы и оборудование для их производства уже замедлили развитие передовых китайских моделей.

Американским разведслужбам всё же следует продолжать наблюдать за строительством дата-центров, перемещением специалистов и серыми цепочками поставок чипов. Именно в этих областях сосредоточены риски, связанные с государствами.

Автор скептически относится к конкретным предложениям Амодеи ограничить дистилляцию — практику, при которой конкурентную передовую модель используют для дешёвого обучения собственной сопоставимой системы, — и ещё сильнее ужесточить контроль над чипами. По его мнению, эти меры больше похожи на создание конкурентного барьера для Anthropic, замаскированного под политику безопасности.

Автор по-прежнему поддерживает модели с открытыми весами, но они несут собственные долгосрочные риски. Снять защитные ограничения с модели, размещённой локально, технически несложно. Злоумышленник с моделью, у которой сняты ограничения, сможет автоматизировать вред в масштабе, недоступном отдельному человеку, сначала в цифровой сфере, а со временем — возможно, и в физическом мире.

Призывы к правительству не решат проблему

Когда лаборатории передовых моделей призывают вмешаться государство, они не ошибаются в одном: регулирование действительно необходимо. Но, по мнению автора, такой призыв одновременно служит для них прикрытием.

Правительства по замыслу действуют медленно, а большинство западных стран за последние два–три десятилетия скорее ослабляли регулирование технологий, чем усиливали его. Экспертиза и деньги находятся внутри лабораторий, а не в Вашингтоне или Брюсселе.

Если Anthropic, OpenAI и Google DeepMind действительно хотят, чтобы общие стандарты безопасности появились быстрее, чем будет принят закон, они могут уже завтра опубликовать методику и открыть исходный код защитных механизмов. Им мешает только коммерческое стремление сохранить преимущество над конкурентами.

Автор также не принимает подразумеваемый аргумент о том, что клиенты не станут платить за безопасность. Общественный запрос на безопасный ИИ есть. Компания CARMA, занимающаяся анализом общественных настроений в медиа, опросила более 6 300 человек в 19 странах. Доля тех, кто доверяет ИИ, выросла с 26% в предыдущем году до 30% в 2026-м. Впервые доверие стало главной эмоциональной реакцией общества на ИИ.

Одновременно 59% опрошенных считают, что компании преувеличивают масштабы использования ИИ и злоупотребляют модными словами. Участники также назвали именно ИИ-компании и разработчиков, а не государство, главными ответственными за решение проблемы.

Пользователям ИИ не не хватает готовности платить за безопасность. Им не хватает уверенности, что поставщики действительно выполнят обещания. И сами поставщики дали достаточно причин для такого недоверия.

Автору внушают надежду сообщения о том, что Anthropic, OpenAI и Google с июля регулярно встречаются, чтобы обсудить общую организацию по стандартизации ИИ. Она могла бы быть ближе к Управлению по регулированию финансовой индустрии США, или FINRA, чем к государственному регулятору: отрасль создала бы её для самой себя.

Эти совместные обсуждения начались ещё до эссе Амодеи. Это показывает, что лаборатории понимают необходимость настоящего саморегулирования, а не одних заявлений. Иначе они рискуют получить законодательные меры, которые им понравятся ещё меньше.

Пять шагов для лабораторий передовых моделей

Автор предлагает начать с пяти направлений.

1Строже контролировать доступ к самым способным моделям. Нужно оценивать не только возможности системы, но и того, кто получает к ней доступ. Подход Anthropic к Mythos можно использовать как рабочую основу: наиболее мощную версию предоставлять проверенным государственным структурам и предприятиям, а широкой публике выпускать защищённую версию. Такую модель доступа стоит распространить шире.

Общество уже принимает ограничения на продажу обычным людям военных дронов и полностью автоматического оружия. К передовым моделям следует применять тот же принцип. Нужен ли типичному корпоративному пользователю неограниченный доступ к самым способным системам, независимо от того, может ли он оплатить нужное количество токенов? Автор считает, что нет.

2Ввести настоящее саморегулирование и прозрачно отчитываться о нём. В проверках должны участвовать и независимые третьи стороны — в духе обязательства по встроенным оценщикам, которое ранее предложила сама Anthropic. Автор считает эту идею действительно полезной, хотя в остальном эссе, по его мнению, заходит недостаточно далеко.
3Создать общие защитные механизмы, которые сложно удалить. Отрасли следует совместно профинансировать и разработать набор защитных ограничений, желательно на основе управления с открытым исходным кодом, а не закрытой системы, привязывающей пользователей к одному поставщику. У лабораторий есть необходимые средства, и их следует направить на эту работу.
4Не заставлять регуляторов писать правила с нуля. Лабораториям стоит подготовить проекты законов, доработать их вместе с государственными органами, добиться принятия и встроить соблюдение требований непосредственно в продукты. У компаний есть и техническая экспертиза, и лоббисты, способные объяснить законодателям эффективность таких мер. Эти ресурсы можно использовать не только для отсрочки регулирования.
5Создать инспекционный орган с реальными полномочиями. Его можно построить по модели Международного агентства по атомной энергии, которое проверяет ядерные объекты. Такой орган должен иметь постоянный доступ к передовым дата-центрам и процессам обучения моделей. Добровольный доступ оценщиков — начало, но он не заменяет независимый контроль.

Что могут делать пользователи

Всё это не освобождает от ответственности остальных. Делать вид, что мы ничего не понимаем в кибербезопасности, больше нельзя.

Пользователям стоит внимательнее относиться к защите собственных устройств и учётных записей. Нужно критически оценивать, насколько тесно должна быть связана с сетью домашняя автоматизация. Изоляция систем от интернета больше не выглядит параноидальной мерой, а некоторые элементы дома, возможно, стоит сделать менее «умными».

Следует самостоятельно разбираться в происходящем, а не полагаться только на заявления поставщиков. У компаний нужно напрямую спрашивать:

защищены ли их системы;
есть ли у них план действий при инциденте;
почему им следует доверять свои данные, если они не могут ясно ответить на эти вопросы.

Для некоторых пользователей честный ответ будет означать переход на локальные решения там, где это разумно. Сейчас такой путь сложнее, чем раньше, но он может оказаться необходимым.

Замедление — только начало

Амодеи стоит признать заслугу в том, что он открыто заговорил о проблеме и предложил реальное обязательство по привлечению встроенных сторонних оценщиков.

Но эссе не заменяет политику, а добровольное замедление компаний, которые конкурируют за капитал и долю рынка, не является защитным механизмом. У отрасли есть деньги, экспертиза и всё больше внимания общества. Их пора использовать для создания устойчивой системы, а не только для публикации хорошо написанных текстов от имени гендиректоров.

Как основателям пользоваться ИИ, не становясь от него зависимыми Новый тип ИИ-модели от одного из создателей ChatGPT приводит разработчиков в восторг Почему Европа осталась в стороне от главного спора о безопасности ИИ Внутренние системы OpenAI взломали с помощью Claude от Anthropic менее чем за 72 часа Первый технический директор Disney возглавлял стартап, который компания обвиняла в копировании персонажей Губернатор Калифорнии Гэвин Ньюсом подписал указ: ИИ-моделям — «выключатель» Жена Марка Цукерберга установила жёсткие ограничения на использование ИИ их 11-летней дочерью Может ли ИИ представлять серьёзную угрозу для нашего существования? OpenAI нацелилась на юридический рынок с Astra for Law Если бы ИИ-индустрия прислушалась к собственным исследованиям, она уже могла бы взять паузу Большинство американцев теперь в ужасе от ИИ «Критический момент»: Британия не поспевает с мерами против рисков ИИ ИИ-супер-ПАКи влили почти $1 млн в малоизвестную гонку в Сенат Приютите этот плюшевый дата-центр — и услышите его пронзительный крик Anthropic: Claude ведёт четверть её исследований, но «ведёт» — не то, что вы думаете OpenAI «этично взломали» с помощью чат-бота Claude от Anthropic 42 ведущих математика предупреждают: экзистенциальный риск ИИ реален и требует срочной реакции Раскол на левом фланге вокруг угрозы гибели человечества от ИИ Napster возвращается — и хочет создавать цифровых двойников учителей Призрак биологического оружия с помощью ИИ — тревожный звонок для биотехнологий

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram