i
Новости
Новости · 2026-09-26

Я создала интерактивного цифрового аватара — и с ним можно поговорить

@neuronium_ai @neuronium_ai

TechCrunch протестировала интерактивного цифрового аватара журналистки Доминик-Мадори Дэвис, созданного Synthesia. Он отвечает на вопросы только об одной её статье — о мошенничестве в стартапах с венчурным финансированием. Для аватара записали голос и сделали фотографии, а его ответы обрабатывает связка моделей для распознавания речи, языка, синтеза голоса и генерации видео. Опыт заставил Дэвис задуматься, смогут ли аватары заменить журналистов: она считает, что доверие читателей нельзя передать ИИ.

Обложка: Я создала интерактивного цифрового аватара — и с ним можно поговорить

Летом Александру Войка, руководитель по корпоративным связям Synthesia, прислал журналистке ссылку на своё цифровое подобие. Интерактивный аватар отвечал на частые вопросы прессы о компании и её работе. Накануне Дэвис участвовала в дискуссии, где специалисты по связям с общественностью спрашивали её, беспокоит ли её текст для предложений, созданный ИИ. Аватар Войки показался ей куда более радикальным примером применения ИИ в пиаре.

В сентябре Synthesia пригласила Дэвис в новый офис в Нью-Йорке. Компания родом из Великобритании и работает на рынке цифровых аватаров наряду с D-ID, HeyGen и Colossyan. Ранее в этом году её оценили в 4 миллиарда долларов, а в прошлом году она сообщила, что годовая регулярная выручка превысила 100 миллионов долларов.

Synthesia помогает компаниям создавать обучающие видео с ИИ-аватарами. Недавно она запустила продукт Roleplay Sessions: сотрудники могут тренироваться, например, проводить презентации для продаж, общаясь с интерактивным аватаром, который отвечает им и оценивает их реплики.

Когда на открытии нового офиса Дэвис предложили сделать собственного ИИ-аватара, она сразу согласилась: ей хотелось получить цифрового двойника, тем более что в тот день она была хорошо одета и уложила волосы.

До встречи со своим двойником Дэвис относилась к аватарам без особого интереса, хотя и ожидала, что они станут частью повседневной жизни в интернете. Она слышала, что пользователи Instagram создают похожие на себя аватары, чтобы делать контент для соцсетей. Идея казалась ей интересной, поэтому она решила показать читателям своего цифрового двойника.

Это первый случай, когда Synthesia создала аватара для журналиста — и вообще для кого-то, кроме Войки. Модель обучили на статье Дэвис о том, почему стартапы с венчурным финансированием чаще занимаются мошенничеством, чем компании без такой поддержки. Аватар отвечает только на вопросы об этой статье.

Чтобы начать общение, нужно нажать «начать в новом окне». Ему можно задать, например, такие вопросы:

Почему я решила написать эту статью?
О чём исследовательская работа?
К каким выводам пришли исследователи?

Для создания аватара Дэвис пришла в небольшую студию в офисе Synthesia. Там её сфотографировали и записали две минуты её голоса. Она дала согласие на создание аватаров — так появился цифровой Дом. Synthesia сделала персонального аватара, который читает любой предложенный ему текст, и две его версии — в очках и без. Также компания создала два интерактивных аватара, способных слушать и отвечать, тоже в вариантах с очками и без.

Команда выбрала статью для обучения интерактивного аватара, а затем собрала его из нескольких компонентов: моделей преобразования речи в текст, языковых моделей, моделей синтеза голоса и генерации видео. В технологическую основу вошли собственные модели Synthesia для видео и голоса. При этом компания позволяет клиентам выбирать решения других разработчиков, например Cartesia, ElevenLabs, Google или OpenAI. Компании также могут разместить аватары в выбранном ими облаке или заплатить Synthesia за хостинг.

Модель распознавания речи превращает слова собеседника в текст. ИИ-агент на языковой модели интерпретирует его и может выполнять действия. Затем модель синтеза речи преобразует ответ в аудио, а видеомодель Synthesia анимирует аватара во время разговора.

Synthesia выпускает три вида продуктов:

платформу для создания и распространения видео с обычными аватарами: пользователь вводит сценарий, а аватар его произносит;
платформу Sessions с ИИ-агентами, где люди могут общаться с аватарами в опросах и ролевых упражнениях;
платформу API, которая позволяет сочетать модели Synthesia для видео и голоса с другими технологиями и создавать интерактивные аватары или другие продукты.

На создание аватаров Дэвис у команды Synthesia ушло несколько дней. Сначала она испытала персональные версии: ввела довольно обычный сценарий о том, что в Нью-Йорк пришла осень — её любимое время года. Синтезированный голос оказался достаточно похож на её собственный. Дэвис обрадовалась, что в нём не проявилась хрипота, которая была у неё во время записи образца.

Знакомым, далёким от технологий, аватар показался одновременно интересным и жутковатым.

Затем Дэвис показала им интерактивную версию. Она работает детерминированно: произносит только то, чему её научили отвечать. В данном случае это была статья о мошенничестве в стартапах с венчурным финансированием. Дэвис спрашивала, чем занималась до TechCrunch и в каком районе Нью-Йорка живёт, но аватар каждый раз возвращал разговор к статье.

Друзья сочли, что голос мало похож на голос Дэвис, а сходство уступает персональному аватару. И всё же цифровой двойник был достаточно похож, чтобы вызывать лёгкую тревогу. Мама журналистки назвала его «потрясающим» — для неё это высокая похвала. Вместе с отцом она пыталась задавать аватару вопросы о Дэвис, ответы на которые, как им казалось, могли знать только они. Но модель всякий раз перенаправляла их к статье о венчурном мошенничестве.

После проверки мама пошутила, что не помнит, как родила двоих детей.

Этот опыт заставил Дэвис задуматься о будущем журналистики. Будут ли люди готовы включать новости, которые ведёт аватар? Один инвестор сразу ответил отрицательно. Многие уже выступают против низкокачественного контента, созданного ИИ и заполнившего соцсети и другие платформы для распространения новостей. Но собеседники Дэвис не пришли к единому мнению. Могут ли аватары помогать журналистам или даже заменить их? Захотят ли генеральные директора общаться с аватаром журналиста, а не с самим человеком?

Дэвис нравится знакомиться с людьми, писать статьи и изучать новые темы. Но основа журналистики — доверие. Она не верит, что эту часть работы можно передать ИИ.

За пределами журналистики идея цифрового клонирования может быть привлекательной. После праздника или отпуска не придётся наверстывать рабочие дела: ваша цифровая версия сможет оставаться на связи и отвечать на вопросы.

Пока неясно, как аватары будут распространяться в американских компаниях. Собственный двойник оставил у Дэвис смешанные чувства. Когда первая новизна прошла, она долго всматривалась в аватара после того, как тот замолчал. Возможно, она ждала, что он моргнёт, улыбнётся, скажет что-то новое или хотя бы даст понять, что знает о её присутствии.

Но цифровые двойники Дэвис работают детерминированно и не могут этого сделать. Она понимает, как легко человек мог бы немного увлечься общением с ИИ, если бы аватар был недетерминированным — например, работал на чат-боте, которому позволено свободно рассуждать.

Дэвис сказала одному инвестору, что, по её прогнозу, поколение Z вряд ли привыкнет к цифровым двойникам. Они кажутся научной фантастикой: всё, что раньше показывали в фильмах, теперь стало реальностью. При этом цифровые аватары тревожат её меньше, чем человекоподобные роботы. Если общение с аватаром станет странным, можно просто выйти из системы.

В конце Дэвис предлагает посмотреть на своего персонального аватара: он рассказывает о главных статьях сайта за неделю.

Глав OpenAI и Anthropic вызвали на сенатское расследование после инцидентов с вышедшими из-под контроля ИИ-агентами Споры об ИИ уже влияют на выборы 2028 года: чего хотят кандидаты от демократов Нарушенные обещания и отобранные земли: в крошечной индийской деревне строят ИИ-дата-центр гигантского масштаба OpenAI пыталась скрыть, что ChatGPT подробно объяснял школьному стрелку, как добиться максимального числа жертв. Переписки ужасают. Оксфорд разрешил OpenAI обучать ИИ-модели на материалах Бодлианской библиотеки Muse от Meta — только для взрослых. Почему он похож на детскую игрушку? SoL-Pi от Nvidia почти вдвое сокращает расход токенов у кодинг-агентов, оптимизируя управляющий слой GPT-6 Astra от OpenAI теперь точно укажет, где вы ошиблись при сборке мебели IKEA Провоста Дартмута поймали на использовании ИИ для статей в газетах и научных журналах Одного письма на общедоступный адрес недостаточно, чтобы защитить австралийцев от потенциальной катастрофы из-за ИИ OpenAI приостанавливает работу с самыми мощными моделями после того, как агенты обошли ограничения и утекли данные OpenAI: агенты слили 53 изображения пользователей ChatGPT — новый случай самовольных действий ИИ Писателя обвинили в использовании ИИ при написании книги и сняли с длинного списка французской премии Перед IPO в США британская ИИ-облачная компания Nscale привлекла $3,36 млрд через конвертируемые облигации Взлом OpenAI правительственной системы Австралии обнажил тревогу в центре глобальной дилеммы искусственного интеллекта На Meta Connect умные очки компании были повсюду Борьба властей Нового Южного Уэльса с «подделанными ИИ» объявлениями об аренде упёрлась в мурал на стене Astra и Opus прошли ещё одно испытание Тьюринга Crusoe отказалась от плана на $1,25 млрд по использованию турбин Boom в ИИ-дата-центрах Незащищённые агенты OpenAI выложили в интернет 53 пользовательских изображения без ведома компании

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram