i
Новости
Новости · 2026-09-23

Alibaba выпустила Qwen Audio 3.1 и новые модели, снизив цены на ИИ-аудио максимум на 95%

@neuronium_ai @neuronium_ai

ИИ-команда Alibaba Qwen выпустила Qwen-Audio-3.1 — линейку из пяти моделей для распознавания речи, синтеза речи и взаимодействия в реальном времени. Обновлённая модель распознаёт больше языков и диалектов, убирает слова-паразиты и повторы, а ASR-Next определяет говорящих, расставляет временные метки и распознаёт эмоции, фоновые и машинные звуки. Модели синтеза поддерживают перенос голоса между языками и управление интонацией через промты. Стоимость синтеза речи снизилась примерно на 70%, режима реального времени — на 85%, а распознавания речи — максимум на 95%.

Обложка: Alibaba выпустила Qwen Audio 3.1 и новые модели, снизив цены на ИИ-аудио максимум на 95%

В состав Qwen-Audio-3.1 входят пять моделей для трёх основных задач: распознавания речи, синтеза речи и общения в реальном времени.

Модель распознавания речи стала лучше работать с разными языками и диалектами. Она автоматически удаляет слова-паразиты и повторы. ASR-Next дополнительно умеет:

определять нескольких говорящих;
добавлять временные метки;
распознавать эмоции;
выявлять фоновые звуки;
определять шум работающих машин.

Модель синтеза речи поддерживает многоязычную генерацию и естественный перенос голоса между языками. Эмоцию, скорость и стиль можно задавать простыми текстовыми промтами. Например, промт Read this with a sharp, commanding tone, demanding respect. просит модель прочитать текст резким, властным тоном, который требует уважения.

TTS-Next объединяет языковую модель с диффузионным методом. Она за один проход генерирует голос, звуковые эффекты и фоновое аудио.

Модель для работы в реальном времени умеет одновременно слушать и говорить, а также сразу реагировать на перебивание. По данным Qwen, если система распознаёт подавленное настроение собеседника, она отвечает медленнее и проявляет больше эмпатии.

Alibaba также изменила цены:

70%снижение стоимости синтеза речи
85%снижение стоимости режима реального времени
95%максимальное снижение стоимости распознавания речи
Инженер: ИИ сеет хаос — кодеры весь день жмут «Enter», не думая и не понимая код AT&T автоматизацией избавляется от рабочих мест — и старой телеком-империи Умные очки Meta уже сеют хаос в Индии OpenAI наняла сооснователя Patreon Сэма Яма во главе нового подразделения Creator Product «Мы уже сражаемся в битве вчерашнего дня»: премьер Греции откровенно об ИИ Бёрнэм: новое британское ведомство даст отпор «информационной войне» России и других стран Как ИИ вообще может «убить всех людей»? Пять самых вероятных сценариев Ник Клегг может заработать £30 млн на выходе стартапа дата-центров Nscale на биржу Snorkel AI утроила оценку до $3,5 млрд на фоне бума спроса на данные для обучения ИИ C2C заменяет текстовую передачу данных между ИИ-моделями Трамп: ИИ не нужно регулировать — с климатом отсутствие правил тоже работает Qualcomm представила два новых чипа для смартфонов с упором на ИИ Бывший авиадиспетчер в ужасе: новая ИИ-система будет галлюцинировать и вызовет катастрофу Meta признала: сходство Muse с OpenClaw не случайно OpenAI выпустила GPT-6 Sol и Luna, снизив стоимость API на 50% и более Трамп: после первой личной встречи отношения с Бёрнхэмом лучше, чем со Стармером GPT-6 Sol и Luna от OpenAI вдвое дешевле, но почти не прибавили в производительности OpenAI представила GPT-6 Sol и Luna — с более низкой ценой и меньшим числом ошибок Почему все говорят о Jev — ИИ, который не ведёт диалогов Anthropic: Claude Opus 5.5 обошла Fable 5.1 в агентных тестах при API на 60% дешевле

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram