i
Новости
Новости · 2026-10-07

Anthropic выпустила Claude Haiku 5.5, снизив цену API на 90% до уровня GPT-6 Luna

@neuronium_ai @neuronium_ai

Anthropic выпустила Claude Haiku 5.5 и снизила на 90% стоимость запросов короче 100 000 токенов. Модель рассчитана на повторяющиеся задачи в компаниях: краткое изложение документов, классификацию данных, запросы к базам и небольшие поручения для более мощных ИИ-агентов. Цены начинаются от $0,10 за миллион входных токенов и $0,50 за миллион выходных — столько же стоит GPT-6 Luna от OpenAI. По оценке Anthropic, с учётом размера запросов и изменения расхода токенов типичные нагрузки обходятся примерно на 75% дешевле, чем на Haiku 4.5. Вместе с новинкой компания снизила стоимость чтения кэша Sonnet 5.5 и объявила ежемесячные кредиты API для подписчиков Max и Team.

Обложка: Anthropic выпустила Claude Haiku 5.5, снизив цену API на 90% до уровня GPT-6 Luna

Роль Haiku в работе ИИ-агентов

Anthropic предлагает использовать Haiku как вспомогательную модель для Opus и Sonnet. Для сложных задач по программированию компания по-прежнему рекомендует более крупные модели. В примере финансовой ИИ-компании Rogo большая модель готовит презентацию, а Haiku находит цифру выручки для одного из слайдов.

Алекс Ван, специалист по прикладному ИИ в Rogo, в заявлении, переданном Anthropic, отметил, что Haiku достаточно точна для такой работы и при этом достаточно быстра и дешева, чтобы запускать её часто.

Самые низкие цены — для коротких запросов

У сниженных тарифов есть ограничение: при запросах длиннее 100 000 токенов Haiku 5.5 стоит $0,50 за миллион входных и $2,50 за миллион выходных токенов. Это на 50% меньше, чем цена Haiku 4.5, тогда как для запросов ниже порога снижение составляет 90%.

В материалах Anthropic не уточняется, как тарифицируются запросы ровно на 100 000 токенов и какие именно токены учитываются при определении порога.

По оценке Anthropic, около 90% запросов к Haiku 4.5 относятся к короткой категории. Компания также оценивает среднюю экономию на типичных нагрузках примерно в 75%, учитывая обновлённый токенизатор: он делит содержимое на оплачиваемые единицы и расходует на эквивалентную работу немного больше токенов.

Сравнение Haiku с OpenAI, Google и Grok

Новые цены делают Haiku конкурентоспособной среди закрытых моделей, но не означают, что она стала самой дешёвой на рынке. GPT-6 Luna от OpenAI предлагает такие же четыре тарифа, как Haiku в нижнем ценовом диапазоне, включая чтение кэша.

В опубликованном сравнении указаны базовые цены и более высокие тарифы при объёме входных данных свыше 272 000 токенов. Стандартные цены по акции действуют до 31 декабря 2026 года. Источники — материалы Anthropic и официальные прайс-листы GPT-6 Luna, GPT-6.1 Sol, Gemini и Grok, проверенные 7 октября. В цифры не включены кэширование, скидки на пакетную обработку, инструменты, региональные надбавки и индивидуально согласованные тарифы. Сравнение касается стоимости, а не равенства возможностей моделей.

Пороговые значения тоже различаются: верхний тариф Haiku в пять раз выше нижнего, а надбавка для Luna начинается после 272 000 входных токенов. По одной лишь цене токенов нельзя определить стоимость выполненной задачи — на неё также влияют расход токенов, повторные попытки и точность.

Результаты бенчмарков зависят от уровня усилий

В таблице бенчмарков Anthropic Haiku 5.5 превосходит Haiku 4.5 и опережает GPT-6 Luna в приведённых ниже тестах, тогда как Sonnet 5.5 показывает лучшие результаты. Эти данные сообщила сама Anthropic; независимой проверки нет.

В тесте OSWorld 2.1 на выполнение действий за компьютером использовалась офлайн-выборка. В результатах FrontierCode для Sonnet указан высокий уровень усилий; прочерк означает, что результат не предоставлен. Первые две строки таблицы показывают баллы, а не проценты.

В Haiku 5.5 появились настраиваемые уровни усилий; по умолчанию выбран средний. Это важно для интерпретации результатов: на диаграмме Anthropic по Terminal-Bench оценка около 39% получена на максимальном уровне усилий, а на среднем — около 20%.

Клиенты сообщают о росте скорости, но данных о пропускной способности нет

Anthropic называет Haiku своей самой быстрой моделью при стандартной скорости работы, но признаёт, что Opus в режиме Fast Mode работает быстрее. В изученных для этой статьи материалах компания не приводит скорость в токенах в секунду.

Отзывы клиентов дают отдельные примеры. Яшодха Бхавнани, вице-президент по ИИ-продуктам Box, сообщила об улучшении на 11 пунктов по сравнению с Haiku 4.5 и примерно вдвое меньшей задержке, не уточнив шкалу оценки. Аарон Винь, ведущий программный инженер Asana, рассказал, что задержка выполнения задач снизилась более чем на 30%, а инференс за ход агента ускорился максимум в 2,5 раза по сравнению с неназванной моделью.

Зив Клапоу, ведущий программный инженер HubSpot, сообщил о среднем результате 92,8% за три запуска внутренней оценки CRM. Среди проверенных компанией моделей это был лучший показатель. Эти отзывы предоставили сами компании; они не позволяют напрямую сравнить пропускную способность моделей разных поставщиков.

Снижение цены Sonnet и кредиты API для подписчиков

Одновременно Anthropic снизила цену чтения кэша Sonnet 5.5 с $0,20 до $0,10 за миллион токенов.

По оценке компании, на типичных нагрузках с ИИ-агентами это даёт экономию около 20%. Фактический результат зависит от того, как часто приложение повторно использует сохранённый контекст.

На этой неделе начнут выдавать ежемесячные кредиты API: $100 подписчикам Max 5x, $200 — Max 20x и до $500 на всех пользователей подписки Team. Кредиты можно потратить на любую модель через платформу Anthropic. В предоставленном проекте материалов не объясняется, как распределяются кредиты Team и переносятся ли они на следующий месяц.

Облачные платформы и ограничения при развёртывании

Anthropic сообщает, что Haiku доступна через собственную платформу компании, AWS, Google Cloud и Microsoft Azure. Идентификатор API — claude-haiku-5-5. Обновления пакетов Python и TypeScript добавляют бета-возможности для управления браузерами и компьютерами. Некоторые действующие клиенты Azure и Google Cloud получат снижение цены кэширования Sonnet в течение следующих дней.

По сравнению с Haiku 4.5 модель получила более строгие ограничения в сфере кибербезопасности: стандартные меры защиты блокируют тестирование на проникновение. Организации, которым нужен более широкий доступ к возможностям в кибербезопасности или биологии, могут подать заявку через программы верификации Anthropic.

Для корпоративных разработчиков практическая проверка — сможет ли Haiku надёжно выполнять узко заданные поручения при частом использовании. Более низкие цены и заявленные улучшения делают такую проверку привлекательнее; результаты собственных бенчмарков Anthropic при этом поддерживают подход, при котором сложные задачи остаются за более крупными моделями.

Смогут ли фильмы о Цукерберге, Маске и Альтмане поколебать веру в техногигантов? Новый ChatGPT больше показывает, чем рассказывает Google рассчитывает превратить обычных игроков в разработчиков игр с помощью новой функции Playground на базе Gemini Новый ИИ определяет по скану мозга, о чём вы думаете Meta внедряет ИИ-инструменты для поиска рекламы, скрытно ведущей к материалам о сексуальном насилии над детьми OpenAI запустила Decisions API: он сводит сложную оценку к ответу «да», «нет» или выбору одного варианта Мужчина признался, что ему стало стыдно, когда ИИ-агент выложил в рабочий Slack его банковские балансы и подробный список расходов Agent Lightning v1.0: лёгкий фреймворк для агентного обучения с подкреплением на 3 500 строк кода — с реальными агентскими пайплайнами Пентагон рассчитывает ускорить закупки ИИ для «цепочки поражения» с помощью пятиминутных видео Отставной полковник ВВС предупреждает: жизнь рядом с дата-центрами опасна — вас могут атаковать или убить Новый сайт Google распознаёт созданные ИИ изображения, видео и аудио с помощью SynthID Австралия строит всё больше жилья. Но не тормозит ли бум дата-центров стройку домов? Тэтчеризм через Walkman: культурологические исследования Стюарта Холла в Британии сохранили в цифровом архиве McDonald’s обвинили в нарушении антимонопольных законов из-за ИИ-инструмента для расчёта цен во франшизах OpenAI хочет поручить своему новому агенту всю вашу жизнь. Мой признался мне в любви Проверка выявила: ChatGPT for Teens от OpenAI — «небезопасная» неразбериха Ваша следующая любимая книга может получить знак «органическая» Достаточно ли регулирования, чтобы ИИ не уничтожил человечество? Теперь Claude можно открыть прямо в Google Docs, Sheets и Slides — и наоборот, файлы Google можно открывать и редактировать в Claude Сэм Альтман-миллиардер просит не бояться ИИ: риски достаются нам, деньги — ему

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram