Роль Haiku в работе ИИ-агентов
Anthropic предлагает использовать Haiku как вспомогательную модель для Opus и Sonnet. Для сложных задач по программированию компания по-прежнему рекомендует более крупные модели. В примере финансовой ИИ-компании Rogo большая модель готовит презентацию, а Haiku находит цифру выручки для одного из слайдов.
Алекс Ван, специалист по прикладному ИИ в Rogo, в заявлении, переданном Anthropic, отметил, что Haiku достаточно точна для такой работы и при этом достаточно быстра и дешева, чтобы запускать её часто.
Самые низкие цены — для коротких запросов
У сниженных тарифов есть ограничение: при запросах длиннее 100 000 токенов Haiku 5.5 стоит $0,50 за миллион входных и $2,50 за миллион выходных токенов. Это на 50% меньше, чем цена Haiku 4.5, тогда как для запросов ниже порога снижение составляет 90%.
В материалах Anthropic не уточняется, как тарифицируются запросы ровно на 100 000 токенов и какие именно токены учитываются при определении порога.
По оценке Anthropic, около 90% запросов к Haiku 4.5 относятся к короткой категории. Компания также оценивает среднюю экономию на типичных нагрузках примерно в 75%, учитывая обновлённый токенизатор: он делит содержимое на оплачиваемые единицы и расходует на эквивалентную работу немного больше токенов.
Сравнение Haiku с OpenAI, Google и Grok
Новые цены делают Haiku конкурентоспособной среди закрытых моделей, но не означают, что она стала самой дешёвой на рынке. GPT-6 Luna от OpenAI предлагает такие же четыре тарифа, как Haiku в нижнем ценовом диапазоне, включая чтение кэша.
В опубликованном сравнении указаны базовые цены и более высокие тарифы при объёме входных данных свыше 272 000 токенов. Стандартные цены по акции действуют до 31 декабря 2026 года. Источники — материалы Anthropic и официальные прайс-листы GPT-6 Luna, GPT-6.1 Sol, Gemini и Grok, проверенные 7 октября. В цифры не включены кэширование, скидки на пакетную обработку, инструменты, региональные надбавки и индивидуально согласованные тарифы. Сравнение касается стоимости, а не равенства возможностей моделей.
Пороговые значения тоже различаются: верхний тариф Haiku в пять раз выше нижнего, а надбавка для Luna начинается после 272 000 входных токенов. По одной лишь цене токенов нельзя определить стоимость выполненной задачи — на неё также влияют расход токенов, повторные попытки и точность.
Результаты бенчмарков зависят от уровня усилий
В таблице бенчмарков Anthropic Haiku 5.5 превосходит Haiku 4.5 и опережает GPT-6 Luna в приведённых ниже тестах, тогда как Sonnet 5.5 показывает лучшие результаты. Эти данные сообщила сама Anthropic; независимой проверки нет.
В тесте OSWorld 2.1 на выполнение действий за компьютером использовалась офлайн-выборка. В результатах FrontierCode для Sonnet указан высокий уровень усилий; прочерк означает, что результат не предоставлен. Первые две строки таблицы показывают баллы, а не проценты.
В Haiku 5.5 появились настраиваемые уровни усилий; по умолчанию выбран средний. Это важно для интерпретации результатов: на диаграмме Anthropic по Terminal-Bench оценка около 39% получена на максимальном уровне усилий, а на среднем — около 20%.
Клиенты сообщают о росте скорости, но данных о пропускной способности нет
Anthropic называет Haiku своей самой быстрой моделью при стандартной скорости работы, но признаёт, что Opus в режиме Fast Mode работает быстрее. В изученных для этой статьи материалах компания не приводит скорость в токенах в секунду.
Отзывы клиентов дают отдельные примеры. Яшодха Бхавнани, вице-президент по ИИ-продуктам Box, сообщила об улучшении на 11 пунктов по сравнению с Haiku 4.5 и примерно вдвое меньшей задержке, не уточнив шкалу оценки. Аарон Винь, ведущий программный инженер Asana, рассказал, что задержка выполнения задач снизилась более чем на 30%, а инференс за ход агента ускорился максимум в 2,5 раза по сравнению с неназванной моделью.
Зив Клапоу, ведущий программный инженер HubSpot, сообщил о среднем результате 92,8% за три запуска внутренней оценки CRM. Среди проверенных компанией моделей это был лучший показатель. Эти отзывы предоставили сами компании; они не позволяют напрямую сравнить пропускную способность моделей разных поставщиков.
Снижение цены Sonnet и кредиты API для подписчиков
Одновременно Anthropic снизила цену чтения кэша Sonnet 5.5 с $0,20 до $0,10 за миллион токенов.
По оценке компании, на типичных нагрузках с ИИ-агентами это даёт экономию около 20%. Фактический результат зависит от того, как часто приложение повторно использует сохранённый контекст.
На этой неделе начнут выдавать ежемесячные кредиты API: $100 подписчикам Max 5x, $200 — Max 20x и до $500 на всех пользователей подписки Team. Кредиты можно потратить на любую модель через платформу Anthropic. В предоставленном проекте материалов не объясняется, как распределяются кредиты Team и переносятся ли они на следующий месяц.
Облачные платформы и ограничения при развёртывании
Anthropic сообщает, что Haiku доступна через собственную платформу компании, AWS, Google Cloud и Microsoft Azure. Идентификатор API — claude-haiku-5-5. Обновления пакетов Python и TypeScript добавляют бета-возможности для управления браузерами и компьютерами. Некоторые действующие клиенты Azure и Google Cloud получат снижение цены кэширования Sonnet в течение следующих дней.
По сравнению с Haiku 4.5 модель получила более строгие ограничения в сфере кибербезопасности: стандартные меры защиты блокируют тестирование на проникновение. Организации, которым нужен более широкий доступ к возможностям в кибербезопасности или биологии, могут подать заявку через программы верификации Anthropic.
Для корпоративных разработчиков практическая проверка — сможет ли Haiku надёжно выполнять узко заданные поручения при частом использовании. Более низкие цены и заявленные улучшения делают такую проверку привлекательнее; результаты собственных бенчмарков Anthropic при этом поддерживают подход, при котором сложные задачи остаются за более крупными моделями.
Читайте также
Смогут ли фильмы о Цукерберге, Маске и Альтмане поколебать веру в техногигантов?
Новый ChatGPT больше показывает, чем рассказывает
Google рассчитывает превратить обычных игроков в разработчиков игр с помощью новой функции Playground на базе Gemini
Новый ИИ определяет по скану мозга, о чём вы думаете
Meta внедряет ИИ-инструменты для поиска рекламы, скрытно ведущей к материалам о сексуальном насилии над детьми
OpenAI запустила Decisions API: он сводит сложную оценку к ответу «да», «нет» или выбору одного варианта
Мужчина признался, что ему стало стыдно, когда ИИ-агент выложил в рабочий Slack его банковские балансы и подробный список расходов
Agent Lightning v1.0: лёгкий фреймворк для агентного обучения с подкреплением на 3 500 строк кода — с реальными агентскими пайплайнами
Пентагон рассчитывает ускорить закупки ИИ для «цепочки поражения» с помощью пятиминутных видео
Отставной полковник ВВС предупреждает: жизнь рядом с дата-центрами опасна — вас могут атаковать или убить
Новый сайт Google распознаёт созданные ИИ изображения, видео и аудио с помощью SynthID
Австралия строит всё больше жилья. Но не тормозит ли бум дата-центров стройку домов?
Тэтчеризм через Walkman: культурологические исследования Стюарта Холла в Британии сохранили в цифровом архиве
McDonald’s обвинили в нарушении антимонопольных законов из-за ИИ-инструмента для расчёта цен во франшизах
OpenAI хочет поручить своему новому агенту всю вашу жизнь. Мой признался мне в любви
Проверка выявила: ChatGPT for Teens от OpenAI — «небезопасная» неразбериха
Ваша следующая любимая книга может получить знак «органическая»
Достаточно ли регулирования, чтобы ИИ не уничтожил человечество?
Теперь Claude можно открыть прямо в Google Docs, Sheets и Slides — и наоборот, файлы Google можно открывать и редактировать в Claude
Сэм Альтман-миллиардер просит не бояться ИИ: риски достаются нам, деньги — ему
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram