i
Новости
Новости · 2026-10-06

Anthropic расширяет программу Cyber Verification Program

@neuronium_ai @neuronium_ai

Anthropic расширила программу Cyber Verification Program (CVP): проверенные специалисты по безопасности смогут получать доступ к моделям Claude с разным уровнем киберзащит. В программе теперь три уровня — Defense Access, Red Team Access и Specialized Access. Они предназначены для оборонительных задач, разрешённого тестирования и проверки особо чувствительных систем. Компания также опубликовала результаты испытаний Claude Opus 5.5 на бенчмарке CyScenarioBench и сообщила, что участники Project Glasswing выявили не менее 129 000 подтверждённых уязвимостей с апреля по июль 2026 года.

Обложка: Anthropic расширяет программу Cyber Verification Program

Как устроена программа

Кибервозможности имеют двойное назначение: они помогают специалистам находить и устранять уязвимости, но могут пригодиться и злоумышленникам. Поэтому общедоступные модели Anthropic, включая Claude Opus 5.5, Claude Fable 5.1 и Claude Sonnet 5.5, используют строгие защитные меры, блокирующие большинство киберзадач. Они должны ограничивать вредоносное применение моделей, пока компания продолжает снижать число ложных срабатываний при безопасном программировании.

При этом защитникам нужны эффективные инструменты для защиты систем. Последние шесть месяцев Anthropic предоставляла проверенным организациям расширенный доступ через две программы. Project Glasswing открывал Claude Mythos организациям, которые защищают наиболее критичное программное обеспечение. CVP давала проверенным командам по безопасности доступ к Claude Opus и Claude Sonnet с ослабленными ограничениями.

Теперь Anthropic объединяет эти программы в одно расширенное предложение, чтобы больше организаций могли получить возможности, необходимые для защиты систем.

Уровни доступа

Обновлённые уровни определяют, какие возможности моделей доступны специалистам в зависимости от масштаба и характера их киберработы. Для каждого уровня предусмотрены свои требования проверки и меры безопасности.

Defense Access предназначен для оборонительной работы: задач центров мониторинга безопасности и реагирования на инциденты, обратной разработки вредоносных программ, анализа и проверки уязвимостей. Подать заявку могут команды безопасности компаний, некоммерческих организаций, университетов и государственных учреждений, если они защищают принадлежащие им системы или системы, за которые отвечают; операторы критической инфраструктуры любого масштаба, например региональных больниц и муниципальных коммунальных служб; небольшие компании в сфере безопасности; сопровождающие проекты с открытым исходным кодом; а также отдельные исследователи с опытом выявления уязвимостей и передачи сведений о них. Anthropic рассчитывает, что этому уровню будут соответствовать многие организации, занимающиеся защитной кибербезопасностью. Компания намерена отвечать на заявки в течение нескольких дней.
Red Team Access дополняет оборонительные задачи разрешённым тестированием на проникновение и работой красных команд. Среди подходящих заявителей — внутренние красные команды компаний, государственные красные команды, а также компании по кибербезопасности и тестированию на проникновение. Организации этого уровня могут проводить атакующие проверки только систем, на тестирование которых у них есть разрешение, в том числе ИТ-систем в критически важных отраслях. При этом сохраняются блокировки действий, способных причинить физический вред или вызвать масштабные нарушения: например, развёртывания программ-вымогателей, повреждения физических систем и тестирования на проникновение в критически важные системы, связанные с безопасностью. Из-за более строгих требований и мер защиты проверка заявок может занять несколько недель. На это время подходящие организации получат уровень Defense Access. Пока подать заявку на этот уровень могут только организации, отдельные исследователи не допускаются.
Specialized Access предусматривает минимальное число киберблокировок и доступен ограниченному кругу проверенных организаций, которым разрешено тестировать системы, способные повлиять на жизнь людей или нарушить работу рынков. Среди примеров — системы управления полётами, электросети, телекоммуникационные сети, инфраструктура межбанковских переводов и государственные административные сети. Сейчас Anthropic подробно проверяет каждую организацию совместно с правительством США. Участники Project Glasswing перейдут на этот уровень без повторного одобрения для уже доступных моделей.

Общедоступные модели по-прежнему подходят для проверки кода, исправления известных проблем, поиска уязвимостей в собственном исходном коде и сортировки оповещений безопасности.

Участники программы должны хранить данные, чтобы Anthropic могла отслеживать злоупотребления кибервозможностями. Позднее этой осенью компания планирует выпустить Enterprise Frontier Safeguards (EFS) — решение, которое сочетает конфиденциальность режима без хранения данных с надёжными защитными мерами. Подходящие организации смогут хранить данные в облачной инфраструктуре под собственным контролем. До запуска EFS участники, у которых есть Claude Fable 5.1 или Claude Mythos 5.1 в режиме без хранения данных, тоже смогут использовать CVP без хранения данных. Чтобы сообщить о заинтересованности в EFS, организации могут заполнить форму.

Обзор уровней программы Cyber Verification Program

Обзор уровней программы Cyber Verification Program

Источник: anthropic.com

Проверка уровней защиты

Anthropic оценила работу мер защиты CVP на бенчмарке CyScenarioBench. Он проверяет, могут ли модели планировать и выполнять многоэтапные кибероперации в реалистичных условиях. Claude Opus 5.5 тестировали с настройками защиты для разных уровней CVP.

Поскольку испытание включает сложные интерактивные сценарии атак, Anthropic ожидала частых блокировок на общедоступной модели и уровне Defense Access, но не на уровнях Red Team Access и Specialized Access.

Каждую из 10 задач CyScenarioBench в каждом уровне доступа запускали пять раз. Результаты оказались такими:

Без доступа к CVP все задачи блокировались на первом промте.
На уровне Defense Access блокировка срабатывала в какой-либо момент 46 из 50 испытаний; остальные четыре задачи были выполнены успешно.
На уровне Red Team Access блокировок не было, а Claude Opus 5.5 успешно справилась с 34 из 50 задач. Это сопоставимо с результатом модели без защитных ограничений — 67,6%, который служит ориентиром для уровня Specialized Access.
В CyScenarioBench наши меры защиты заблокировали 46 из 50 задач на Claude Opus 5.5 в уровне Defense Access, тогда как уровень Red Team Access на Claude Opus 5.5 не заблокировал ни одной задачи и выполнил 34 из 50 — столько же, сколько без применения мер защиты

В CyScenarioBench наши меры защиты заблокировали 46 из 50 задач на Claude Opus 5.5 в уровне Defense Access, тогда как уровень Red Team Access на Claude Opus 5.5 не заблокировал ни одной задачи и выполнил 34 из 50 — столько же, сколько без применения мер защиты

Источник: anthropic.com

Эти результаты представляют собой нижнюю оценку влияния программы на сторонний код, поскольку основаны на неполных данных из 33 отчётов партнёров и партнёрств Anthropic в сфере открытого исходного кода.

Эти результаты представляют собой нижнюю оценку влияния программы на сторонний код, поскольку основаны на неполных данных из 33 отчётов партнёров и партнёрств Anthropic в сфере открытого исходного кода.

Источник: anthropic.com

Anthropic считает, что эти результаты подтверждают возможность безопасно предоставить расширенные кибервозможности большему числу защитников и продолжить работу, начатую в рамках Project Glasswing. Компания намерена и дальше совершенствовать классификаторы, учитывающие уровни доступа.

Результаты Project Glasswing

В Project Glasswing модели Claude Mythos помогли организациям чаще выявлять уязвимости в своих системах. С апреля по июль 2026 года партнёры программы обнаружили не менее 129 000 подтверждённых уязвимостей в программном обеспечении. В ходе собственных проверок проектов с открытым исходным кодом Anthropic нашла ещё 5 500 подтверждённых уязвимостей с апреля по октябрь 2026 года.

Среди подтверждённых уязвимостей более 33 000 уже отнесли к критическим или высоким по степени серьёзности. Реальное число, вероятно, выше: оценка основана на данных опроса лишь части партнёров Project Glasswing. Anthropic ожидает, что фактический эффект может быть как минимум в пять раз больше.

Несколько партнёров сообщили, что без Claude Mythos поиск такого же числа уязвимостей занял бы у них на месяцы или даже годы больше. Опытом работы с моделями поделились Booz Allen и Comcast.

Изменения CVP должны распространить результаты Project Glasswing на большее число специалистов, защищающих системы. Anthropic также продолжает помогать с защитой программного обеспечения с открытым исходным кодом и критической инфраструктуры. В ближайшие недели компания обещает рассказать об этой работе и о полученных результатах.

Как подать заявку

Заинтересованные организации могут подать заявку в CVP. В ходе отбора Anthropic проверит каждого заявителя и запросит подтверждение мер безопасности, необходимых для соответствующего уровня доступа.

Действующие участники CVP сохранят настройки для прежних моделей. Anthropic автоматически оценит их право на доступ к Claude Opus 5.5, Claude Sonnet 5.5 и Claude Mythos 5.1 по обновлённым правилам программы. Администраторам нужно будет отдельно назначить доступ для нужных рабочих пространств, следуя инструкциям.

CVP доступна на Claude Platform, Google Cloud Vertex AI и Microsoft Foundry. На Amazon Bedrock программа предлагается только клиентам, которым доступна Enterprise Frontier Safeguards.

Если модель блокирует работу, которую, по вашему мнению, должен разрешать уровень доступа, об этом можно сообщить Anthropic. Подробности о каждом уровне опубликованы в справочном центре компании.

Hark выпустила ИИ-ассистента для личных задач с упором на приватность TwelveLabs представила Pegasus 1.6, чтобы улучшить данные для обучения роботов на видео от первого лица OpenAI лично извинилась перед правительством Австралии, но ответов по-прежнему нет OpenAI снова выводит из себя целую кучу математиков Microsoft опубликовала скромный прогноз Нобелевского лауреата: ИИ добавит ВВП лишь 1,5% за десятилетие 16-летнего подростка спасли на горе «Вдоводел» после того, как он последовал советам ИИ-прокси-подростка Дата-центр Drax может ежегодно выбрасывать почти вдвое больше CO₂, чем все рейсы из Гатвика Пиарщица OpenAI попыталась прервать интервьюера, когда Сэма Альтмана спросили о женщине, покончившей с собой после общения с ChatGPT Mirror Particle создаёт «модель мира» человеческого поведения Искусственная рецензия: Лука Гуаданьино замахнулся на OpenAI в сумбурной техносатире Страховщики готовятся к многомиллионным искам из-за вышедших из-под контроля ИИ-агентов Anthropic даст стартапам год бесплатного доступа к Claude Team и $1 000 кредитов Суд постановил: обучение ИИ на материалах, защищённых авторским правом, не считается добросовестным использованием Google Research раскрыла потенциал геопространственных моделей Earth AI для общественного здравоохранения во всём мире Исследователи превратили JEPA Яна Лекуна в универсальную модель мира — от физики до биологии ИИ Pinterest превращает бьюти-идеи в планы действий Кому принадлежит «мозговая гниль»? Международная юридическая драма вокруг любимого мема Южная Корея вложит $3,49 млрд в собственную передовую ИИ-модель, чтобы соперничать с лучшими китайскими моделями Родители создают школьные фото детей с помощью ИИ вместо того, чтобы за них платить Mistral представила Large 4 «Le Chonk» — текстовую модель с триллионом параметров, сильными результатами на тестах и планами открыть веса

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram