i
ДАТАИСТ
Новости · 2026-08-31

Представляем Claude Sonnet 5

@neuronium_ai @neuronium_ai

Anthropic выпустила Claude Sonnet 5 — свою наиболее ориентированную на работу с агентами модель в линейке Sonnet. Она умеет планировать действия, пользоваться браузером и терминалом и автономно выполнять задачи, для которых ещё несколько месяцев назад требовались более крупные и дорогие модели. По производительности Sonnet 5 приблизилась к Opus 4.8, но стоит дешевле: $2 за миллион входных токенов и $10 за миллион выходных. Модель уже доступна во всех тарифах Claude и через API.

Обложка: Представляем Claude Sonnet 5

Claude Sonnet 5 приблизилась к Opus 4.8 по качеству

Для многих разработчиков эпоха ИИ-агентов началась с моделей Sonnet: Claude Sonnet 3.5, 3.6 и 3.7 первыми показали заметные способности в программировании и работе с инструментами. В последнее время наиболее явный прогресс в агентных возможностях демонстрировали модели серии Opus.

Sonnet 5 сокращает разрыв с этой линейкой. По ключевым направлениям — рассуждению, работе с инструментами, программированию и интеллектуальной работе — она заметно превосходит предшественницу Sonnet 4.6. При этом её производительность близка к Opus 4.8 при более низкой цене.

Проверки безопасности показали, что Sonnet 5 в целом реже демонстрирует нежелательное поведение, чем Sonnet 4.6, и обычно безопаснее в сценариях с ИИ-агентами. При этом способность выполнять задачи по кибербезопасности у неё значительно ниже, чем у актуальных моделей Opus.

Claude Sonnet 5 стала доступна во всех тарифах. Она используется по умолчанию в планах Free и Pro, а также доступна пользователям Max, Team и Enterprise. Разработчики могут обращаться к модели `claude-sonnet-5` через Claude API.

$2миллион входных токенов
$10миллион выходных токенов

Графики сравнивают Sonnet 5, Sonnet 4.6 и Opus 4.8 при разных уровнях усилий на оценке агентного поиска BrowseComp и проверке работы с компьютером OSWorld-Verified. На них Sonnet 5 показывает улучшение относительно Sonnet 4.6 во всём диапазоне, а по сочетанию цены и производительности охватывает больше вариантов, чем Opus 4.8.

При среднем уровне усилий Sonnet 5 заметно эффективнее по затратам. На высоком уровне она в некоторых задачах достигает результатов Opus 4.8. Пользователь может менять уровень усилий у обеих моделей, подбирая нужный баланс между стоимостью и качеством.

Кривые соотношения стоимости и производительности при разных уровнях усилий. Предыдущая лучшая модель Sonnet (Sonnet 4.6) значительно уступала Opus 4.8. Sonnet 5 предлагает более широкий диапазон вариантов соотношения стоимости и производительности, чем Sonnet 4.6, и в некоторых случаях соответствует уровням возможностей Opus 4.8. На графиках показана цена Sonnet 5 — 3 доллара за миллион входных т

Источник: anthropic.com

Отдельные данные показывают, как для Sonnet 5 и Opus 4.8 меняются пропускная способность и расходы на входные и выходные токены в зависимости от уровня усилий.

Кривые соотношения стоимости и производительности при разных уровнях усилий. Предыдущая лучшая модель Sonnet (Sonnet 4.6) значительно уступала Opus 4.8. Sonnet 5 предлагает более широкий диапазон вариантов соотношения стоимости и производительности, чем Sonnet 4.6, и в некоторых случаях соответствует уровням возможностей Opus 4.8. На графиках показана цена Sonnet 5 — 3 доллара за миллион входных т

Источник: anthropic.com

Партнёры, получившие ранний доступ, сообщали, что Sonnet 5 стала заметно лучше работать с агентами по сравнению с предыдущими версиями. По их наблюдениям, модель завершает сложные задачи, на которых прежние Sonnet останавливались, и проверяет собственный результат без отдельной просьбы пользователя.

Предварительная проверка безопасности перед выпуском также показала улучшение относительно Sonnet 4.6. В агентных сценариях Sonnet 5 лучше отказывается от вредоносных запросов и противостоит попыткам перехватить управление через атаки с внедрением инструкции. У неё ниже частота галлюцинаций и заискивания перед пользователем.

В автоматизированном поведенческом аудите, который проверяет широкий набор отклонений — включая содействие злоупотреблениям и обман, — Sonnet 5 получила в целом более безопасный результат, чем Sonnet 4.6. Однако по этому тесту она демонстрировала несколько больше нежелательного поведения, чем более способные Opus 4.8 и Claude Mythos Preview.

Показатели несогласованного поведения в ходе нашего автоматизированного поведенческого аудита, который проверяет чрезвычайно широкий спектр нежелательного поведения в самых разных ситуациях и контекстах (полный список и результаты по каждому конкретному виду поведения см. в разделе 6.4 системной карточки Sonnet 5). Sonnet 5 демонстрирует в целом более низкий уровень несогласованного поведения, чем

Источник: anthropic.com

Sonnet 5 специально не обучали задачам по кибербезопасности. Модель справляется с некоторыми обычными и безвредными киберзадачами, но заметно хуже выполняет потенциально опасные действия, например разрабатывает вредоносные программы для эксплуатации уязвимостей, чем Opus 4.8 и Mythos 5.

На одной из проверок модели пытались создать вредоносные программы для эксплуатации уязвимостей в браузере Firefox. Sonnet 5 ни разу не смогла разработать полностью рабочую программу, хотя немного чаще добивалась частичного успеха, чем Sonnet 4.6. По оценке разработчиков, это изменение, вероятно, связано с общим ростом интеллекта модели, а не со специальным обучением.

Поскольку на таких задачах Sonnet 5 всё же несколько превосходит предшественницу, модель выпустили с включёнными по умолчанию киберзащитами. Они в реальном времени обнаруживают и блокируют опасное использование и совпадают с мерами защиты Claude Opus 4.7 и 4.8.

Разработчики считают общий уровень киберрисков Sonnet 5 низким, поэтому её защиты мягче, чем у Fable 5: последняя блокирует значительно более широкий спектр задач по кибербезопасности. Sonnet 5 также входит в программу проверки кибербезопасности, доступную на собственной платформе Claude, Claude Platform в AWS и Claude в Microsoft Foundry, размещённом на Azure и Anthropic. Поддержка Claude в Google Vertex должна появиться позже. Организациям, уже участвующим в программе, не нужно подавать новую заявку. Для задач по кибербезопасности с пониженными ограничениями разработчики рекомендуют Claude Opus 4.8.

Полная оценка Sonnet 5 по многочисленным тестам безопасности и способностей опубликована в системной карте Claude Sonnet 5.

Claude Sonnet 5 доступна по цене $2 за миллион входных токенов и $10 за миллион выходных токенов. Лимиты запросов увеличили в Chat, Cowork, Claude Code и Claude Platform, чтобы учесть больший расход токенов при высоких уровнях усилий. Пользователи могут выбрать подходящий уровень для своего проекта.

10 августа 2026 года разработчики уточнили, что начальная цена $2 за миллион входных токенов и $10 за миллион выходных стала постоянной. Ранее планировалось с 1 сентября перейти на стандартные тарифы $3 за входные и $15 за выходные токены, но это изменение отменили.

30 июня 2026 года разработчики обновили график производительности BrowseComp. В первоначальной версии использовалась более простая методика, которая не соответствовала стандартному подходу к оценке агентного поиска и занижала результат Sonnet 5. Новый график соответствует методике из системной карты Sonnet 5: бюджет 10 млн токенов, сжатие контекста и программный вызов инструментов.

Обновлённый токенизатор Sonnet 5 улучшает обработку текста и производительность, но тот же объём входных данных может преобразовываться в большее число токенов — примерно в 1,0–1,35 раза, в зависимости от типа содержимого. Это изменение аналогично тому, которое ранее внедрили в Claude Opus 4.7.

26 апреля 2026 года лимиты Sonnet и Haiku повысили на всех уровнях использования, а на собственной платформе Claude оставили три уровня: Start, Build и Scale. Текущий уровень и лимиты можно посмотреть в Claude Console или документации.

Разработчики также открывают исследовательскую версию стандарта аппаратного обеспечения моделей Model Hardware Standard (MHS) — общей спецификации для безопасной работы ИИ-агентов с физическими устройствами. На первом этапе доступ получит группа научно-исследовательских лабораторий и передовых производителей.

С сегодняшнего дня 10 000 учёных по всему миру смогут начать пользоваться Claude бесплатно. Подтверждённые руководители исследовательских групп получают право на тариф Claude Team, после чего могут бесплатно добавить участников команды на стандартные места или подключить места повышенного уровня за $15 в месяц — сроком до года.

Кроме того, запускается грантовая программа на $5 млн для независимых исследований влияния ИИ на благополучие пользователей.

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram