Обновление от 22 сентября 2026 года: добавлены результаты бенчмарков Artificial Analysis.
Цена и расход токенов
Anthropic установила для Opus 5.5 цену $4 за миллион входных токенов и $20 за миллион выходных. У Opus 5 эти показатели составляли $5 и $25. Таким образом, стоимость токенов снизилась на 20%. Чтение кэша теперь обходится на 60% дешевле.
Компания утверждает, что общие эксплуатационные расходы, учитывающие и цену токенов, и их количество, примерно на 40% ниже, чем у Opus 5. Новая модель использует меньше токенов, а её ответы появляются более чем на 30% быстрее.
Пятнадцатиминутные лимиты для подписчиков увеличат на 20%. С учётом более низкой стоимости Anthropic ожидает, что в целом они позволят выполнить на 25% больше работы. Пользователи также смогут сохранить сброс лимита до момента, когда он понадобится.
Anthropic использует бенчмарки для программирования, чтобы показать соотношение цены и производительности:
Снижение цены стало ответом на давление со стороны OpenAI и особенно китайских ИИ-моделей: они уступают по производительности, но стоят лишь небольшую долю от стоимости более мощных решений.
Меньше «Claudish»
Anthropic также обещает, что Opus 5.5 будет общаться естественнее предыдущих моделей. Она должна сначала сообщать главное, реже использовать жаргон и точнее следовать инструкциям по стилю текста. Первые тестировщики назвали её ответы более ясными и понятными. По мнению Anthropic, это делает модель удобнее для длительной совместной работы.
Текущие версии Claude часто критиковали за шаблонный и запутанный стиль, который иногда называют «Claudish».
Источник: the-decoder.com
Opus 5.5 стала первой моделью семейства Opus с мерами безопасности для кибербезопасности, биологии и разработки передовых языковых моделей на уровне Fable 5.1. Когда срабатывают эти ограничения, запросы, по словам Anthropic, прозрачно перенаправляются другой модели.
Пользователи по-прежнему смогут искать и исправлять ошибки в коде, но большинство задач по кибербезопасности будет передаваться более старой Opus 4.8. Запросы, которые классификаторы отнесут к биологии или разработке передовых языковых моделей, будут направляться в Opus 5.
Проверенные организации смогут подать заявку на использование модели для биологических исследований через Life Sciences Verification Program. В ближайшие недели Anthropic намерена расширить действующую Cyber Verification Program, включив в неё Opus 5.5.
Claude Opus 5.5 уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики, работающие с Claude Platform, могут обращаться к ней по идентификатору claude-opus-5-5.
Anthropic призывает повысить требования к безопасности
Anthropic планирует строже проверять среды для обучения с подкреплением. Компания считает, что плохо устроенные среды обучения — один из главных источников поведения моделей, не соответствующего заданным целям. Параллельно она работает над более качественными наградами для согласования поведения моделей, автоматическим созданием сценариев для обучения безопасности, а также усилением мер безопасности и мониторинга.
ИИ-лаборатории спорят о том, как быстро выпускать более способные модели. OpenAI недавно призвала разработать международные стандарты для систем, способных улучшать самих себя. Несколько исследователей публично предложили замедлить выпуск новых моделей, пока методы согласования поведения не начнут соответствовать их возможностям.
Anthropic занимает похожую позицию и призывает установить более высокий стандарт безопасности для моделей, которые смогут полностью автоматизировать исследования в области ИИ. Компания считает, что государственная политика должна сильнее влиять на формирование этого стандарта. До выпуска Opus 5.5 её тестировали внешние организации Frontier Design и METR.
Ограничения против дистилляции
Anthropic вводит меры против так называемых атак дистилляции. По словам компании, злоумышленники используют тысячи поддельных аккаунтов, чтобы в промышленном масштабе извлекать способности модели и создавать мощные модели без встроенных механизмов безопасности. Anthropic ссылается на отчёт об угрозах за сентябрь 2026 года, в котором описана выявленная и остановленная компанией незаконная активность по дистилляции.
В Opus 5.5 появилась функция «Preserved Thinking», впервые представленная в Fable 5.1. Она не позволяет пользователям API редактировать предыдущий контекст Claude, чтобы извлекать из него рассуждения. Ограничение распространяется на Fable 5.1 и Opus 5.5 в аккаунтах API, созданных 31 августа 2026 года или позднее.
В Opus 5.5 также появились меры с водяными знаками для соблюдения требований Закона ЕС об ИИ. Модель больше нельзя запускать с отключённым режимом «Thinking», при этом она доступна в режиме Zero Data Retention.
Artificial Analysis поставила Opus 5.5 на первое место
Независимая платформа Artificial Analysis подтверждает высокие результаты Opus 5.5. На максимальном уровне усилий модель набрала 58 баллов в Artificial Analysis Intelligence Index — это самый высокий результат за всю историю индекса, на несколько пунктов выше прежнего лидера. Opus 5.5 возглавила шесть из десяти оценок:
Claude Opus 5.5 возглавляет индекс интеллекта Artificial Analysis с 58 баллами; за ним следуют Claude Fable 5.1 и GPT-6 Astra, набравшие по 53 балла. На графике соотношения стоимости и производительности (внизу) несколько уровней интенсивности Opus 5.5 находятся на границе Парето
Источник: the-decoder.com
По данным Artificial Analysis, Opus 5.5 вывела Anthropic на один уровень с GPT-6 Astra в Terminal-Bench 4.0 и AutomationBench-AA, а также увеличила отрыв в агентной работе со знаниями. В закрытом бенчмарке AA-Briefcase модель получила рейтинг Эло 1 822 — на 143 пункта больше, чем Fable 5.1. Это первый случай, когда модель Anthropic превзошла GPT-5.6 Sol по качеству презентаций. В GDPval-AA, бенчмарке OpenAI для оценки работы в офисных профессиях, Opus 5.5 обошла Astra во всех режимах рассуждения, кроме низкого.
В тесте GDPval-AA v2.1 Claude Opus 5.5 набирает более высокие баллы Elo, чем конкуренты, при сопоставимой или меньшей стоимости за задание почти на всех уровнях интенсивности. Только при настройке «low» Astra оказывается впереди
Источник: the-decoder.com
Artificial Analysis отмечает и компромисс по эффективности. На максимальном уровне усилий Opus 5.5 расходует около 119 000 выходных токенов на задачу — заметно больше, чем Opus 5 с 73 000, Fable 5.1 с 78 000 и GPT-6 Astra с 27 000. Более низкая цена токенов удерживает стоимость одной задачи примерно на уровне Opus 5, но не делает её ниже.
При этом четыре из пяти режимов усилий Opus 5.5 находятся на границе Парето: по стоимости задачи они сравниваются или превосходят все остальные модели, набравшие больше 50 баллов в индексе.
Читайте также
DraftKings использует ИИ, чтобы выявлять зависимых игроков и подсаживать их
Как UK AISI и EvalEval делают результаты бенчмарков воспроизводимыми
AstroForge передаёт ИИ управление своим следующим космическим аппаратом
Джордж Осборн из OpenAI: противники дата-центров тормозят развитие Британии
Rabbit возвращается — теперь с приложением ИИ-агента
OpenAI призывает к международным стандартам для ИИ, способного к самоулучшению
Трамп в ООН: США теперь называют ИИ «сверхинтеллектом» во всех официальных документах
IPO Nscale вновь проверит готовность Уолл-стрит к концентрированным ставкам на ИИ
Техногиганты говорят: ИИ может найти лекарство от рака. Так где же оно?
ИИ-модели на основе мозга крыс стали ближе к реальности
Есть ли скрытая причина общего замедления развития ИИ?
Новый чат-бот хочет раскрыть тайны ветхих древнегреческих текстов
Крошечный слой ПО на основе лабораторных нейронов обещает ускорить и удешевить ИИ-видео
Новый ИИ-агент Meta Muse может стать самым жутким из когда-либо выпущенных
Барбара Маццолаи хочет создать новое направление в робототехнике
У каждого найдётся причина не любить строительство дата-центров
Очки Vonder от Viture призваны составить карту вашего сознания
OpenAI: внутренняя модель за месяц обучения решила более 100 давних математических задач
Новый безумный сайт позволяет стрелять в тире из турелей «менее смертоносными» боеприпасами
ИИ и «разговоры с животными»: нам — умнее, а им что?
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram