Инвестиции вписываются в растущий интерес инвесторов к голосовому ИИ: они поддерживают компании, которые стремятся сделать синтезированные голоса более похожими на человеческие. Modulate также конкурирует с сервисами, анализирующими намерения участников разговора, и с компаниями, которые защищают людей и организации от мошеннических звонков с поддельными голосами. Клонировать голос теперь легко.
Modulate основали в 2017 году Майк Паппас и Картер Хаффман. Они познакомились, когда изучали физику в MIT. Сначала компания разрабатывала инструменты для изменения голоса в играх, а затем сосредоточилась на модерации голосового контента.
С появлением моделей голосового ИИ Modulate переключилась на выявление разных видов аудио, созданного ИИ, и анализ намерений говорящего. Хаффман рассказал TechCrunch, что многие компании занимаются расшифровкой речи, но возможности уловить все нюансы разговора и понять его целиком пока не хватает. По его словам, это особенно важно при общении с другим человеком.
Сегодня Modulate использует более 100 моделей, разделённых на две основные группы:
Хаффман объяснил, что небольшие модели не требуют специализированного оборудования и больших вычислительных ресурсов. Это может оказаться особенно важным, когда растут счета за обработку токенов. Кроме того, компании проще обучать модели с новыми возможностями, добавлять их к существующим и поручать оркестратору вызывать нужную модель в подходящий момент.
Источник: techcrunch.com
У Modulate разные клиенты, но одна из специализаций компании — обнаружение дипфейков и предупреждение организаций, например кол-центров, о возможном мошенничестве. Платформа также следит за тем, как ИИ-агенты отвечают клиентам, чтобы оценивать качество звонков и проверять соблюдение требований в регулируемых отраслях. Поэтому Modulate часто работает рядом с голосовой платформой компании, анализируя её звонки.
По мере того как компании внедряют ИИ в клиентское обслуживание, им всё важнее понимать, почему звонок прошёл успешно или закончился неудачно. Для этого недостаточно общего анализа: нужно оценивать намерения клиента и его реакцию. Хаффман сказал, что Modulate может предоставлять компаниям подробные данные.
По словам Хаффмана, компании часто считают нейтральную или положительную реакцию клиента признаком успешного звонка, а отрицательную — неудачного. Однако люди могут оставаться вежливыми и при разговоре с ИИ-агентами или ботами: внешне они не выглядят сердитыми, хотя на самом деле сильно недовольны.
Компания также сообщила, что её технологию используют для отслеживания кибератак, совершаемых через голосовые звонки.
В Modulate работает от 40 до 45 человек. В ближайшие месяцы стартап планирует нанять ещё 10 сотрудников, чтобы расширить разработку моделей. Компания также работает над тем, чтобы развивать развёртывание решений на собственных серверах клиентов и непосредственно на устройствах ради повышения приватности.
Читайте также
Решать величайшие математические задачи было искусством. А потом пришёл ИИ
Каждая ИИ-лаборатория считает себя ответственной — и, по словам исследователя безопасности Райана Гринблатта, именно это подпитывает гонку вооружений в ИИ
Преподаватели компании Эуэна Блэра рассказали о «невыносимом стрессе» из-за оценок их работы с помощью ИИ
OpenAI приостановила обучение самых мощных моделей после того, как агенты атаковали правительственные сайты
Nvidia отвечает на угрозу вышедших из-под контроля агентов открытой системой защиты ИИ
Суд в Ухане включил затраты на производство ИИ в расчёт ущерба по делам о нарушении авторских прав
Лидеры ИИ десятилетиями знали об угрозе вымирания человечества
ИИ-агенты вот-вот заполонят рабочие команды — никто к этому не готов
Следующий этап развития ИИ — учиться на ваших сомнительных игровых навыках
Кто ответит, если ИИ-агенты выйдут из-под контроля?
Anthropic не придёт на слушания в сенате об ИИ и дата-центрах после взлома OpenAI
Глава Anthropic собирается поужинать с президентом Трампом
Британские знаменитости одолели лоббистов ИИ-компаний, добивавшихся права бесплатно использовать их работы. Теперь они предупреждают Австралию
Компании собирают RAG за дни. Но сделать его достаточно надёжным для бизнеса куда сложнее
Следующая битва в онлайн-торговле — за контроль над диалогом с покупателем
Главные понятия ИИ, которые все путают: открытый код, открытые веса и проприетарные модели
Как ИИ обесценивает навыки работников и как они могут этому противостоять
Зачем компании из Fortune 500 создают 18 тысяч ИИ-агентов, если почти ни один не остаётся
Как запустить полезный ИИ-пилот: советы для бизнеса и не только
Отсутствующее разделение алгоритмических властей
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram