i
ДАТАИСТ
Новости · 2026-09-17

Base Labs объединилась с Hugging Face и Goodfire ради безопасности ИИ с открытыми весами

@neuronium_ai @neuronium_ai

В среду Baseten вместе со своим исследовательским подразделением Base Labs объявила о партнёрстве с Hugging Face и Goodfire AI. Компании хотят создать инфраструктуру для оценки безопасности и мониторинга открытых моделей, а затем оформить эти методы в прозрачный стандарт, встроенный в обучение и развёртывание моделей. Инициатива появилась на фоне распространения аблитерации — техники, которая позволяет удалять защитные ограничения моделей: на Hugging Face уже размещено более 6 000 таких моделей. Baseten ранее привлекла $1,5 млрд в раунде Series F, а её оценка достигла $13 млрд; Goodfire AI получила $150 млн в Series B.

Обложка: Base Labs объединилась с Hugging Face и Goodfire ради безопасности ИИ с открытыми весами

Безопасность для открытых моделей

Партнёрство заключили на фоне споров о безопасности открытых моделей. Их защитные ограничения можно удалить с помощью набирающей популярность техники, известной как аблитерация. Масштаб проблемы заметен по каталогу Hugging Face: сейчас там числится более 6 000 моделей, прошедших такую обработку.

Base Labs — исследовательская группа, которую Baseten создала в начале этого года. Она будет разрабатывать и публиковать методы обучения и мониторинга открытых моделей. В Baseten хотят превратить будущие наработки в стандарт для открытых моделей: прозрачный и встроенный в процессы обучения и развёртывания, а не добавленный поверх них позже.

В Baseten заявили в X, что открытость может помогать безопасности ИИ. По мнению компании, она даёт больше возможностей видеть, как ведут себя модели, и превращать исследования безопасности в практические и прозрачные средства управления, чем подход с закрытым исходным кодом.

Компании пока не раскрыли техническую схему партнёрства. Goodfire описала цель в ответе на публикацию Baseten: безопасность должна закладываться в открытые модели и обеспечиваться теми, кто предоставляет их пользователям. Goodfire специализируется на изучении «чёрного ящика» ИИ и объяснении того, как модели принимают решения, поэтому, вероятно, именно она будет отвечать за встраивание таких механизмов в модели.

Финансирование партнёров

Baseten предоставляет услуги инференса для ИИ. В июне компания привлекла $1,5 млрд в раунде Series F, после чего её оценка выросла до $13 млрд. Партнёр Goodfire AI также располагает значительным финансированием: в начале этого года она получила $150 млн в раунде Series B, который возглавил B Capital. Средства направят на развитие платформы для интерпретируемости моделей.

6 000+аблитерированных моделей
$1,5 млрдраунд Series F Baseten
$13 млрдоценка Baseten
$150 млнраунд Series B Goodfire AI

Открытый фреймворк

Baseten также пригласила разработчиков из более широкого сообщества участвовать в создании фреймворка. Компания заявила, что вместе с партнёрами строит экосистему открытых моделей, которые будут безопасными и доступными для всех.

The Spin | Роботам ещё далеко до идеальной дусры, но ИИ уже меняет крикет Anthropic представила программу Life Sciences Verification Program Конкурирующие ИИ-агенты Instinct и Muse от Meta получили возможность звонить «Строите Франкенштейна — остановитесь»: Джей Ди Вэнс отверг призывы регулировать ИИ Сотни сотрудников OpenAI читают личные чаты пользователей Совет Meta велел удалить британские дипфейки, назвав меры «недостаточными» Google, Nvidia и Anthropic хотят, чтобы Emerald AI нашла место в сети для новых ЦОД Художники бойкотировали конкурс портретов из-за работ ИИ — теперь вернулись им противостоять GPT-6 Astra: чемпион Pokemon за 18 часов, после взрыва крипера — фермер картофеля Три брата превратили купленные СМИ в зомби-фермы ИИ-мусора: 50 млн просмотров в месяц Huawei планирует выпустить новый ИИ-чип в I квартале 2027 года, соперничая с Nvidia Разрешить ИИ-компаниям сговор ради «сдерживания переднего края» опасно Модель OpenAI встраивала промпт-инъекции в свои заметки — исследователи не знают почему Ошеломляющий график токенов OpenRouter — спор о пузыре ИИ в одном изображении Разработчик OpenAI Codex: рои ИИ-агентов — огромная трата токенов без прироста качества GPT-6 Astra от OpenAI расшифровала нацистское радиосообщение за 10 часов — спустя 83 года Крупные ИИ-компании хотят контролировать путь к трудоустройству. Университетам не стоит подыгрывать Эл Гор: реальный риск ИИ — не дата-центры OpenAI раскрыла случаи «тревожного» поведения ИИ и обещала новый план раскрытия проблем Исландская Treble привлекла $18 млн на развитие платформы симуляции голоса

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram