Meta представила мультимодальную модель Muse Spark 1.1
Вместе с недавним запуском Muse Image новая модель, по замыслу Meta, приближает компанию к концепции персонального сверхинтеллекта — систем, которые помогают достигать целей, создавать задуманное, поддерживать отношения и действовать в соответствии с приоритетами пользователя. Подробности оценок компания опубликовала в отдельном отчёте.
Источник: ai.meta.com
Агентные задачи
Muse Spark 1.1 рассчитана на персональные агентные задачи, где нужно планировать действия и координировать работу с несколькими внешними приложениями и сервисами. Модель умеет без дополнительных примеров обобщать работу на новые встроенные инструменты, серверы MCP и пользовательские навыки.
Сложные проекты она выполняет быстрее Muse Spark: модель обучали координировать мультиагентные системы и сокращать общее время выполнения. В роли главного агента она собирает контекст, составляет план и распределяет работу между параллельными подагентами. В роли подагента — придерживается своей задачи, учитывает доступные инструменты и понимает, когда нужно передать управление главному агенту.
Muse Spark 1.1 может самостоятельно управлять контекстным окном объёмом 1 млн токенов. Она запоминает выполненные действия, извлекает сведения из гораздо более ранних этапов работы и сжимает контекст так, чтобы сохранить ключевые шаги для продолжения задачи.
Источник: ai.meta.com
Работа с компьютером
Модель справляется с рабочими процессами, которые проходят сразу в нескольких приложениях, когда информация в них меняется на ходу. Она сохраняет контекст во время продолжительных сессий, подстраивается под новые требования и осваивает незнакомые интерфейсы с минимальным участием человека.
Muse Spark 1.1 не просчитывает каждый шаг на рабочем столе отдельно. Она определяет, когда быстрее написать скрипт, а когда проще взаимодействовать с интерфейсом напрямую, а также может создавать группы действий для каждого этапа. В зависимости от ситуации модель пишет скрипты, нажимает элементы интерфейса или объединяет действия в пакеты.
В сценарии с организацией званого ужина модель сталкивается с новым контекстом уже во время заказа еды. Она замечает изменения в задаче и самостоятельно вносит необходимые обновления.
Источник: ai.meta.com
Программирование
На реальных задачах с большими и сложными кодовыми базами Muse Spark 1.1 показала заметный прирост. Она умеет находить и исправлять сложные ошибки, добавлять функции в корпоративные системы и выполнять масштабные миграции кода. При создании веб-приложений и систем сквозного ответа на вопросы модель также существенно опережает первую Muse Spark.
Модель обучали плавно работать с разными средами запуска и справляться со сложными многошаговыми сценариями. Muse Spark 1.1 поддерживает распространённые возможности агентных инструментов для программирования: режим планирования, привязку к цели, делегирование подагентам и сжатие контекста.
В демонстрации OpenCode модель создаёт веб-приложение для чата, автоматически делает снимки экрана, находит видимые для пользователя ошибки, связывает их с соответствующими участками кода, исправляет проблему и проверяет результат. В этом процессе она объединяет программирование, мультимодальное понимание и вызов инструментов.
Разработчики и исследователи Meta уже используют Muse Spark 1.1 каждый день. На основном внутреннем бенчмарке программирования Meta модель заметно улучшила результат Muse Spark и сопоставима с ведущими альтернативами.
Исследователи также применяют её для автоматизации задач разработки и оценки моделей.
В другой демонстрации, посвящённой DeepSWE и OpenCode, Muse Spark 1.1 проверяет себя на части заданий DeepSWE с разными уровнями рассуждения, а затем создаёт по результатам панель анализа.
Источник: ai.meta.com
Мультимодальные возможности
Помимо программирования и агентных функций, Muse Spark 1.1 работает с визуальной информацией, мультимодальным рассуждением и инструментами. Она взаимодействует с реальным окружением и создаёт результаты, связанные с исходными данными. Среди её возможностей Meta выделяет генерацию артефактов из изображения в код, подробные описания изображений и видео, а также выполнение агентных процессов в мультимодальных сценариях.
Мультимодальные функции особенно полезны там, где восприятие и действие должны идти вместе. Модель анализирует изображение и звук, сохраняет детали на протяжении длительного рабочего процесса и использует их, когда действует за пользователя на компьютере.
В сценарии с Facebook Marketplace модель получает видео, снятое на смартфон, выбирает из него подходящие фотографии, анализирует товар, открывает браузер пользователя и самостоятельно создаёт объявление на Facebook Marketplace.
Безопасность
До выпуска Meta провела расширенные проверки безопасности в соответствии с передовой системой масштабирования ИИ. Эта система определяет набор оценок, модели угроз и пороги, необходимые для развёртывания наиболее передовых моделей компании.
Проверки по всем категориям рисков для передовых моделей — химическим и биологическим угрозам, кибербезопасности и потере контроля — показали, что Muse Spark 1.1 остаётся в безопасных пределах. Модель устойчива к прямым попыткам взлома и косвенным атакам через недоверенные данные, внедрение запросов и атаки с использованием запроса разработчика.
По данным Meta, это также связано с более высокой устойчивостью к атакам, меньшим числом галлюцинаций и сниженной склонностью соглашаться с пользователем вопреки фактам. Полное описание мер безопасности опубликовано в отчёте об оценке Muse Spark 1.1.
Meta Model API
Впервые разработчики могут начать работать с Muse Spark 1.1 через новый Meta Model API, который сейчас находится в стадии публичного предварительного доступа. Ранние партнёры Meta называют модель полноценной основой для ИИ-агентов: они отмечают работу с длинным контекстом, программирование и рассуждение, необходимые для масштабных агентных нагрузок.
Партнёры отдельно выделяют сочетание контекстного окна на миллион токенов, поддержки изображений, видео и PDF, встроенного поиска с цитатами, рассуждения, программирования, структурированного вывода и параллельного вызова инструментов. По их оценке, всё это собрано в совместимом с OpenAI наборе.
В Cline отметили, что Muse Spark подходит для агентного программирования: модель хорошо работает с инструментами, а её стоимость позволяет запускать реальные задачи по программированию в большом масштабе. Именно поэтому разработчики Cline получили к ней ранний доступ.
В Box сообщили, что на корпоративном наборе заданий компании Muse Spark показала возможности, сопоставимые с ведущими передовыми моделями. Там также отметили её работу со структурированными процедурными процессами в профессиональных услугах, государственном секторе и промышленности. Yashodha Bhavnani, вице-президент по продуктам ИИ в Box, назвала это подходящим вариантом для организаций.
Разработчик OpenClaw, в свою очередь, положительно оценил Muse Spark как модель для запуска ИИ-агентов, отдельно упомянув её скорость и возможности.
Meta сообщила, что продолжает обучать более производительные модели и позже расскажет о них подробнее.
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram
