Доступ к моделям
Как и предыдущая версия Mythos, Mythos 5.1 предназначена только для зарегистрированных партнёров Anthropic из сфер кибербезопасности и наук о жизни. Fable 5.1 можно использовать через облачные платформы или API Anthropic.
Одна из ключевых перемен — Anthropic поддержала режим нулевого хранения данных, при котором клиенты запускают модели на собственной инфраструктуре, не передавая данные наружу. Раньше этот режим был недоступен для Fable из-за проблем с безопасностью.
Корпоративный сервис передовых мер защиты начнёт распространяться среди пользователей в июне. Он по-прежнему будет отслеживать злоупотребления со стороны ИИ-агентов и людей, но клиенты смогут самостоятельно выбирать, как именно будет проходить такой контроль.
В рамках анонса Anthropic заверила клиентов, что к их данным не получали неправомерный доступ. Компания также заявила, что никогда не обучала модели на корпоративных данных без явного разрешения и не собирается делать этого в будущем.
Результаты моделей
Как и в предыдущих выпусках Anthropic, новые модели установили рекорды в нескольких бенчмарках. Среди них:
До официального выпуска модели также создали три новых научных результата. В их числе — собственная оптимизация GPU и карта Венеры высокого разрешения, собранная из уже существующих фотографий.
Что показывает системная карта
Вместе с моделями Anthropic опубликовала подробную системную карту, описывающую их способности и ограничения.
Mythos получила оценку «низкий риск» в категории, связанной с автоматизированной разработкой ИИ — ситуациями, когда ИИ улучшает самого себя. В системной карте говорится, что способность модели ускорять внутренние исследования и разработки в области ИИ соответствует текущим тенденциям.
При этом в вопросах общего нежелательного поведения Mythos немного чаще проваливает проверки, чем Opus. Anthropic объясняет это возможным следствием более высоких способностей модели.
По сравнению с Opus 5 Mythos 5.1 немного хуже справляется с общим риском рассогласованного поведения. Одновременно она лучше Mythos 5 и Claude Sonnet 5. Модель чаще соглашается помогать при злоупотреблениях со стороны людей и охотнее принимает неподтверждённые заявления о наличии разрешения, чем Opus 5.
Зато Mythos 5.1 реже игнорирует явные ограничения, выдумывает входные данные или ложно заявляет, что выполнила задачу, чем предыдущие модели.
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram