i
ДАТАИСТ
Новости · 2026-09-17

PrismML надеется, что её крошечная LLM изменит наше обращение с ИИ

@neuronium_ai @neuronium_ai

Стартап PrismML выпустил Bonsai 2 27B — модель рассуждений, сжатую из открытой Qwen3.8 27B от Alibaba до 5,9 ГБ. Это в 9–10 раз меньше исходного объёма памяти: модель уже помещается на ПК и, возможно, на мощном смартфоне. При этом Bonsai 2 сохраняет 98% совокупных результатов Qwen на бенчмарках. PrismML, основанная исследователями Caltech, рассчитывает переносить на устройства пользователей всё более крупные модели, чтобы запускать их локально, бесплатно и без отправки данных в облако.

Обложка: PrismML надеется, что её крошечная LLM изменит наше обращение с ИИ

PrismML пока известна не масштабом финансирования: стартап привлёк посевной раунд на $22,25 млн. В компании делают ставку на то, что производительные большие языковые модели с рассуждением необязательно должны быть большими.

PrismML создаёт модели рассуждений настолько компактными, что они могут работать на ПК и смартфонах. Также ходят слухи, что компания ведёт переговоры с Apple, но генеральный директор Бабак Хассиби отказался комментировать это TechCrunch.

В четверг PrismML представила Bonsai 2 27B — новую модель в своей линейке. Она сжимает широко используемую открытую модель Qwen3.8 27B от Alibaba до 5,9 ГБ. Это в 9–10 раз меньше памяти, чем требуется оригиналу.

5,9 ГБразмер Bonsai 2 27B
9–10 разсокращение памяти
98%результаты Qwen
11 млнзагрузок первой Bonsai
2,6 млнзагрузок малых моделей

Команда и инвесторы

PrismML основала группа исследователей Caltech. Компанию возглавляет Бабак Хассиби — профессор Caltech и специалист по технологиям сжатия.

Советником стартапа стал Ион Стойка, сооснователь Databricks и других компаний, а также директор знаменитой лаборатории Sky Computing при Калифорнийском университете в Беркли. В этой лаборатории появились многие технологии и стартапы, включая Letta и SGLang.

PrismML поддержали следующие инвесторы:

Khosla Ventures;
Cerberus Capital;
Caltech.

PrismML — не единственная компания, которая занимается сжатием больших языковых моделей. Ещё один пример — Multiverse Computing, основанная известным профессором из испанского Международного физического центра Донoстии. Multiverse Computing уже привлекла значительное финансирование.

Результаты сжатия

По словам Хассиби, технология PrismML отличается тем, что сжатые модели почти не теряют производительность по сравнению с исходными. Bonsai 2 набирает 98% от совокупных результатов Qwen на бенчмарках. Первая Bonsai, выпущенная несколькими месяцами ранее, в марте, показывала 95% от исходного результата.

С того времени первую модель скачали более 11 млн раз. Ещё 2,6 млн загрузок пришлись на более компактные модели PrismML, сообщает компания.

Результаты показывают, что качество сжатия улучшается от одного выпуска к следующему. Достигнет ли PrismML полного совпадения с исходными моделями на бенчмарках, пока неизвестно. Хассиби считает, что сжатие, вероятно, всегда будет немного влиять на результат.

При этом идеальное совпадение на бенчмарках имеет скорее академическое значение. Исходные большие языковые модели не настолько точны, а сами бенчмарки не настолько точно отражают реальные задачи, чтобы снижение результата на 2% заметно повлияло на работу модели в повседневном использовании. На точность также существенно влияет окружающее программное обеспечение — оболочка, внутри которой запускается модель.

Как PrismML уменьшает модели

PrismML уменьшает «веса» модели — информацию, которую она усваивает и хранит во время обучения. Обычно для хранения каждого веса требуется 16 бит.

Подход компании называется тернарными весами. Вместо большого набора значений каждый вес принимает одно из трёх:

+1;
−1;
0.

Благодаря этому для каждого веса нужно хранить гораздо меньше данных, а сама модель занимает значительно меньше места. Более подробное описание технологии сжатия опубликовано на странице проекта в GitHub.

Следующая цель

Теперь стартап хочет применить ту же технологию к ещё более крупным моделям. По словам Хассиби, следующие модели PrismML могут выйти в течение нескольких месяцев и будут иметь от нескольких сотен миллиардов параметров. Он ожидает, что сохранить их способность рассуждать будет проще.

По мере роста модели, объяснил Хассиби, появляется больше возможностей сжать её без потери интеллектуальных способностей. В целом, считает он, крупным моделям проще сохранить 100% исходного качества.

Локальный запуск

Ион Стойка связывает перспективность технологии с тем, что передовые модели смогут работать непосредственно на устройствах пользователей. В этом случае ИИ будет доступен без отдельной платы, поскольку запустится на уже купленном устройстве. Данные также не придётся отправлять в облако, что обеспечит приватность.

Вот как может выглядеть апокалипсис ИИ Робототехника: компании наперегонки улучшают системы обучения роботов Pinterest показала новую функцию Restyle — ИИ поможет переделать комнату Директор Microsoft назвал ИИ «крупнейшей кражей труда в истории человечества» — рассекреченные документы суда Проблему неуправляемых ИИ-агентов может решить ещё больше ИИ Будущее учебной практики: учителя создают интерактивы с генеративным интерфейсом Метрики для оценки темпов развития ИИ в передовых лабораториях ООН обратилась к Google, чтобы подготовить глобальные данные для ИИ-агентов Проект правил: ИИ сможет собирать всё, что публикуют австралийцы. Как вас это затронет? Anthropic приближает Claude Code к автономному кодингу с новыми параллельными агентами Инфлюенсеры снимают на ИИ-очки Meta манипулятивный джойбейт с людьми на улице Даже короля Англии одолевают сомнения по поводу ИИ Господство ИИ не предопределено — мы можем изменить ситуацию к лучшему Спор о замедлении ИИ омрачил праздник Salesforce OpenAI, по сообщениям, близка к решению второй задачи тысячелетия — гипотезы Ходжа Base Labs объединилась с Hugging Face и Goodfire ради безопасности ИИ с открытыми весами The Spin | Роботам ещё далеко до идеальной дусры, но ИИ уже меняет крикет Anthropic представила программу Life Sciences Verification Program Конкурирующие ИИ-агенты Instinct и Muse от Meta получили возможность звонить «Строите Франкенштейна — остановитесь»: Джей Ди Вэнс отверг призывы регулировать ИИ

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram