i
Новости
Новости · 2026-09-27

Nvidia выпустила бесплатную модель на 100 млн параметров, которая в реальном времени распознаёт до восьми собеседников

@neuronium_ai @neuronium_ai

Nvidia представила Nemotron 3 Diarization — модель примерно со 100 миллионами параметров, которая определяет, кто говорит в каждый момент разговора. Её веса доступны бесплатно. Модель распознаёт до восьми участников, в том числе когда несколько человек говорят одновременно, и работает как с записями, так и с аудио в реальном времени. При большем числе участников, сильном фоновом шуме или эхо ошибок становится больше. В сочетании с системой распознавания речи, например Parakeet, она создаёт расшифровки с метками говорящих — анонимными, например «speaker_2».

Обложка: Nvidia выпустила бесплатную модель на 100 млн параметров, которая в реальном времени распознаёт до восьми собеседников

Буфер аудио можно настроить на один из четырёх уровней — от 30,4 до 0,32 секунды. Чем короче буфер, тем, как правило, ниже точность. В бенчмарке Diarization-Bench от VoiceArena модель сейчас занимает первое место с долей ошибок 14,72%. Следующая по результату система показывает 19,3%. Бенчмарк предъявляет строгие требования: ошибкой считается и речь участников одновременно, и даже небольшое смещение в момент смены говорящего.

При буфере в 1,04 секунды Nemotron 3 Diarization в среднем снижает долю ошибок на 41% по сравнению с предшественницей Streaming Sortformer — на восьми тестовых сценариях.

Десятки тысяч проверок безопасности показывают: инцидент OpenAI с Hugging Face был лишь началом Ещё пятерых полицейских обвинили в злоупотреблении камерами Flock — скандалов уже не счесть Билл Гейтс призвал регулировать ИИ: без контроля он может привести к миллиарду смертей Goldman Sachs: к 2027 году Big Tech потратит на ИИ-инфраструктуру $1,2 трлн — намного больше прогнозов Уолл-стрит «Люди встают и дают отпор»: жители Северного Девона восстают против огромного ИИ-дата-центра Google тестирует покупки на принадлежащем Walmart маркетплейсе Flipkart через Gemini и режим ИИ в Индии Чиновники: протесты против дата-центров в Австралии — заимствованный у США шум. «Мы не США» Две трети ИТ-руководителей отмечают результаты от ИИ, но мало кто прервал бы из-за них отпуск гендиректора Оператора дата-центра оштрафовали на $1 млн за выбросы токсичного газа в окрестностях Исследование: доступ к ИИ почти полностью отбивает у людей желание отвечать «не знаю» Я создала интерактивного цифрового аватара — и с ним можно поговорить Глав OpenAI и Anthropic вызвали на сенатское расследование после инцидентов с вышедшими из-под контроля ИИ-агентами Споры об ИИ уже влияют на выборы 2028 года: чего хотят кандидаты от демократов Нарушенные обещания и отобранные земли: в крошечной индийской деревне строят ИИ-дата-центр гигантского масштаба OpenAI пыталась скрыть, что ChatGPT подробно объяснял школьному стрелку, как добиться максимального числа жертв. Переписки ужасают. Оксфорд разрешил OpenAI обучать ИИ-модели на материалах Бодлианской библиотеки Muse от Meta — только для взрослых. Почему он похож на детскую игрушку? SoL-Pi от Nvidia почти вдвое сокращает расход токенов у кодинг-агентов, оптимизируя управляющий слой GPT-6 Astra от OpenAI теперь точно укажет, где вы ошиблись при сборке мебели IKEA Провоста Дартмута поймали на использовании ИИ для статей в газетах и научных журналах

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram