i
Новости
Новости · 2026-09-22

Claude Opus 5.5 не уступает Fable 5.1, дешевле и обещает меньше «клау́довского» текста

@neuronium_ai @neuronium_ai

Anthropic выпустила Claude Opus 5.5 — первую модель нового семейства. Компания заявляет, что по большинству задач она достигает уровня Claude Fable 5.1, обходится примерно на 40% дешевле в эксплуатации и генерирует ответы более чем на 30% быстрее предыдущей версии Opus 5. В ближайшие недели должны выйти Claude Sonnet 5.5 и Haiku 5.5 с похожими улучшениями производительности, эффективности и безопасности. Бенчмарки Anthropic также показывают преимущество Opus 5.5 над Fable 5.1 и более дорогой GPT-6 Astra в большинстве задач.

Обложка: Claude Opus 5.5 не уступает Fable 5.1, дешевле и обещает меньше «клау́довского» текста

Обновление от 22 сентября 2026 года: добавлены результаты бенчмарков Artificial Analysis.

Цена и расход токенов

Anthropic установила для Opus 5.5 цену $4 за миллион входных токенов и $20 за миллион выходных. У Opus 5 эти показатели составляли $5 и $25. Таким образом, стоимость токенов снизилась на 20%. Чтение кэша теперь обходится на 60% дешевле.

Компания утверждает, что общие эксплуатационные расходы, учитывающие и цену токенов, и их количество, примерно на 40% ниже, чем у Opus 5. Новая модель использует меньше токенов, а её ответы появляются более чем на 30% быстрее.

$4за миллион входных токенов
$20за миллион выходных токенов
20%снижение цены токенов
40%снижение общих расходов

Пятнадцатиминутные лимиты для подписчиков увеличат на 20%. С учётом более низкой стоимости Anthropic ожидает, что в целом они позволят выполнить на 25% больше работы. Пользователи также смогут сохранить сброс лимита до момента, когда он понадобится.

Anthropic использует бенчмарки для программирования, чтобы показать соотношение цены и производительности:

FrontierCode — Opus 5.5 превосходит OpenAI GPT-6 Astra при стоимости одной задачи примерно в 20% от цены Astra.
Terminal-Bench 4.0 — показывает такой же результат, как Astra, но обходится в 40% стоимости её задачи.
CursorBench — опережает GPT-5.6 Sol на 11 баллов при стоимости в треть от цены задачи Sol.

Снижение цены стало ответом на давление со стороны OpenAI и особенно китайских ИИ-моделей: они уступают по производительности, но стоят лишь небольшую долю от стоимости более мощных решений.

Меньше «Claudish»

Anthropic также обещает, что Opus 5.5 будет общаться естественнее предыдущих моделей. Она должна сначала сообщать главное, реже использовать жаргон и точнее следовать инструкциям по стилю текста. Первые тестировщики назвали её ответы более ясными и понятными. По мнению Anthropic, это делает модель удобнее для длительной совместной работы.

Текущие версии Claude часто критиковали за шаблонный и запутанный стиль, который иногда называют «Claudish».

Источник: the-decoder.com

Opus 5.5 стала первой моделью семейства Opus с мерами безопасности для кибербезопасности, биологии и разработки передовых языковых моделей на уровне Fable 5.1. Когда срабатывают эти ограничения, запросы, по словам Anthropic, прозрачно перенаправляются другой модели.

Пользователи по-прежнему смогут искать и исправлять ошибки в коде, но большинство задач по кибербезопасности будет передаваться более старой Opus 4.8. Запросы, которые классификаторы отнесут к биологии или разработке передовых языковых моделей, будут направляться в Opus 5.

Проверенные организации смогут подать заявку на использование модели для биологических исследований через Life Sciences Verification Program. В ближайшие недели Anthropic намерена расширить действующую Cyber Verification Program, включив в неё Opus 5.5.

Claude Opus 5.5 уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики, работающие с Claude Platform, могут обращаться к ней по идентификатору claude-opus-5-5.

Anthropic призывает повысить требования к безопасности

Anthropic планирует строже проверять среды для обучения с подкреплением. Компания считает, что плохо устроенные среды обучения — один из главных источников поведения моделей, не соответствующего заданным целям. Параллельно она работает над более качественными наградами для согласования поведения моделей, автоматическим созданием сценариев для обучения безопасности, а также усилением мер безопасности и мониторинга.

ИИ-лаборатории спорят о том, как быстро выпускать более способные модели. OpenAI недавно призвала разработать международные стандарты для систем, способных улучшать самих себя. Несколько исследователей публично предложили замедлить выпуск новых моделей, пока методы согласования поведения не начнут соответствовать их возможностям.

Anthropic занимает похожую позицию и призывает установить более высокий стандарт безопасности для моделей, которые смогут полностью автоматизировать исследования в области ИИ. Компания считает, что государственная политика должна сильнее влиять на формирование этого стандарта. До выпуска Opus 5.5 её тестировали внешние организации Frontier Design и METR.

Ограничения против дистилляции

Anthropic вводит меры против так называемых атак дистилляции. По словам компании, злоумышленники используют тысячи поддельных аккаунтов, чтобы в промышленном масштабе извлекать способности модели и создавать мощные модели без встроенных механизмов безопасности. Anthropic ссылается на отчёт об угрозах за сентябрь 2026 года, в котором описана выявленная и остановленная компанией незаконная активность по дистилляции.

В Opus 5.5 появилась функция «Preserved Thinking», впервые представленная в Fable 5.1. Она не позволяет пользователям API редактировать предыдущий контекст Claude, чтобы извлекать из него рассуждения. Ограничение распространяется на Fable 5.1 и Opus 5.5 в аккаунтах API, созданных 31 августа 2026 года или позднее.

В Opus 5.5 также появились меры с водяными знаками для соблюдения требований Закона ЕС об ИИ. Модель больше нельзя запускать с отключённым режимом «Thinking», при этом она доступна в режиме Zero Data Retention.

Artificial Analysis поставила Opus 5.5 на первое место

Независимая платформа Artificial Analysis подтверждает высокие результаты Opus 5.5. На максимальном уровне усилий модель набрала 58 баллов в Artificial Analysis Intelligence Index — это самый высокий результат за всю историю индекса, на несколько пунктов выше прежнего лидера. Opus 5.5 возглавила шесть из десяти оценок:

на Humanity's Last Exam она набрала 61,4% против прежнего лучшего результата 59,1% у Fable 5.1;
на SciCode получила 66,9% против 63,1% у Fable 5.1;
на Terminal-Bench 4.0 показала 59,6%, сравнявшись с GPT-6 Astra и опередив Opus 5 на 11 баллов.
Claude Opus 5.5 возглавляет индекс интеллекта Artificial Analysis с 58 баллами; за ним следуют Claude Fable 5.1 и GPT-6 Astra, набравшие по 53 балла. На графике соотношения стоимости и производительности (внизу) несколько уровней интенсивности Opus 5.5 находятся на границе Парето

Claude Opus 5.5 возглавляет индекс интеллекта Artificial Analysis с 58 баллами; за ним следуют Claude Fable 5.1 и GPT-6 Astra, набравшие по 53 балла. На графике соотношения стоимости и производительности (внизу) несколько уровней интенсивности Opus 5.5 находятся на границе Парето

Источник: the-decoder.com

По данным Artificial Analysis, Opus 5.5 вывела Anthropic на один уровень с GPT-6 Astra в Terminal-Bench 4.0 и AutomationBench-AA, а также увеличила отрыв в агентной работе со знаниями. В закрытом бенчмарке AA-Briefcase модель получила рейтинг Эло 1 822 — на 143 пункта больше, чем Fable 5.1. Это первый случай, когда модель Anthropic превзошла GPT-5.6 Sol по качеству презентаций. В GDPval-AA, бенчмарке OpenAI для оценки работы в офисных профессиях, Opus 5.5 обошла Astra во всех режимах рассуждения, кроме низкого.

В тесте GDPval-AA v2.1 Claude Opus 5.5 набирает более высокие баллы Elo, чем конкуренты, при сопоставимой или меньшей стоимости за задание почти на всех уровнях интенсивности. Только при настройке «low» Astra оказывается впереди

В тесте GDPval-AA v2.1 Claude Opus 5.5 набирает более высокие баллы Elo, чем конкуренты, при сопоставимой или меньшей стоимости за задание почти на всех уровнях интенсивности. Только при настройке «low» Astra оказывается впереди

Источник: the-decoder.com

Artificial Analysis отмечает и компромисс по эффективности. На максимальном уровне усилий Opus 5.5 расходует около 119 000 выходных токенов на задачу — заметно больше, чем Opus 5 с 73 000, Fable 5.1 с 78 000 и GPT-6 Astra с 27 000. Более низкая цена токенов удерживает стоимость одной задачи примерно на уровне Opus 5, но не делает её ниже.

При этом четыре из пяти режимов усилий Opus 5.5 находятся на границе Парето: по стоимости задачи они сравниваются или превосходят все остальные модели, набравшие больше 50 баллов в индексе.

DraftKings использует ИИ, чтобы выявлять зависимых игроков и подсаживать их Как UK AISI и EvalEval делают результаты бенчмарков воспроизводимыми AstroForge передаёт ИИ управление своим следующим космическим аппаратом Джордж Осборн из OpenAI: противники дата-центров тормозят развитие Британии Rabbit возвращается — теперь с приложением ИИ-агента OpenAI призывает к международным стандартам для ИИ, способного к самоулучшению Трамп в ООН: США теперь называют ИИ «сверхинтеллектом» во всех официальных документах IPO Nscale вновь проверит готовность Уолл-стрит к концентрированным ставкам на ИИ Техногиганты говорят: ИИ может найти лекарство от рака. Так где же оно? ИИ-модели на основе мозга крыс стали ближе к реальности Есть ли скрытая причина общего замедления развития ИИ? Новый чат-бот хочет раскрыть тайны ветхих древнегреческих текстов Крошечный слой ПО на основе лабораторных нейронов обещает ускорить и удешевить ИИ-видео Новый ИИ-агент Meta Muse может стать самым жутким из когда-либо выпущенных Барбара Маццолаи хочет создать новое направление в робототехнике У каждого найдётся причина не любить строительство дата-центров Очки Vonder от Viture призваны составить карту вашего сознания OpenAI: внутренняя модель за месяц обучения решила более 100 давних математических задач Новый безумный сайт позволяет стрелять в тире из турелей «менее смертоносными» боеприпасами ИИ и «разговоры с животными»: нам — умнее, а им что?

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram