Цифровой аватар за пару дней: журналистка TechCrunch собрала ИИ-клона на Synthesia и показала каждый шаг
Цифровой аватар можно собрать за пару дней, если знать, какие инструменты взять и в каком порядке действовать: журналистка TechCrunch прошла весь путь от фотосессии до готового клона и рассказала, что вышло.

Платформа Synthesia уже позволяет бизнесу создавать интерактивных цифровых аватаров, которые отвечают на вопросы, проводят тренинги и заменяют типовые видеозвонки, а весь процесс от съёмки до запуска занимает считанные дни.
Журналистка Доминик Базинет из TechCrunch этой осенью создала собственного цифрового двойника на платформе Synthesia и подробно описала каждый шаг. Synthesia, стартап из Великобритании с офисом в Нью-Йорке, специализируется на генерации видео с ИИ-аватарами. По данным TechCrunch, компания достигла оценки в 4 млрд долларов в 2024 году и сообщила о годовой повторяющейся выручке свыше 100 млн долларов.
Базинет стала первым журналистом, для которого Synthesia сделала цифровой аватар. До неё компания создавала аватар только для своего сотрудника, главы по корпоративным коммуникациям Александру Войки, чтобы тот отвечал на типовые вопросы прессы.
Что понадобится?
- Платформа для создания аватара. Synthesia, HeyGen, D-ID или Colossyan. Synthesia предлагает три продукта: видеоплатформу с классическими аватарами (аватар читает ваш сценарий), агентную (агентный, то есть способный действовать самостоятельно) платформу Sessions для интерактивных сценариев и API для интеграции с другими сервисами.
- Мини-студия или хорошее освещение. В офисе Synthesia журналистку снимали в небольшой фотостудии: несколько ракурсов плюс двухминутная запись голоса.
- Согласие на использование вашего образа. Платформа требует письменное подтверждение, что вы разрешаете создание аватара.
- Материал для обучения интерактивного аватара. Текст, статья или база ответов, на которых аватар будет строить диалог. Базинет загрузила свою статью о венчурном мошенничестве.
- Время. Команде Synthesia потребовалось несколько дней на сборку аватаров.
Пошаговая инструкция
-
Выберите платформу и тип аватара. Synthesia предлагает два основных варианта. Персональный аватар просто озвучивает написанный вами сценарий. Интерактивный аватар слушает собеседника, понимает вопрос и отвечает, но только в рамках загруженного материала.
-
Пройдите фотосессию и запишите голос. Вас фотографируют с разных ракурсов и записывают двухминутный образец речи. Базинет отмечает: платформа не перенесла хрипоту, которая была у неё в день записи, голос получился чище оригинала.
-
Подпишите согласие. Без вашего разрешения аватар не создадут.
-
Подготовьте контент для обучения. Для интерактивного аватара загрузите текст или набор вопросов-ответов. Аватар Базинет был детерминированным (детерминированный значит, что он отвечает строго по загруженному материалу и не придумывает ничего от себя).
-
Выберите технический стек. Цифровой аватар Synthesia работает на связке из четырёх типов моделей:
- Модель преобразования голоса в текст (voice-to-text) распознаёт речь собеседника
- Агентная языковая модель анализирует смысл и формирует ответ
- Модель преобразования текста в голос (text-to-voice) озвучивает ответ
- Видеомодель Synthesia анимирует лицо аватара во время разговора
Клиенты могут подключить альтернативные модели от Cartesia, ElevenLabs, Google или OpenAI, а также разместить аватара на собственном облаке.
- Протестируйте результат. Начните с персонального аватара: напишите простой сценарий и послушайте, как звучит голос. Затем переходите к интерактивному и проверьте, как он отвечает на вопросы по теме и отклоняет вопросы не по теме.
Базинет сначала проверила персональный аватар, набрав простой текст о том, что в Нью-Йорке наступила осень. Голос оказался достаточно похожим. Затем она протестировала интерактивного аватара, обученного на статье о венчурном мошенничестве. На вопросы вроде «Где ты работала до TechCrunch?» или «В каком районе Нью-Йорка живёшь?» аватар каждый раз перенаправлял собеседника обратно к теме статьи. Мама журналистки пыталась задавать личные вопросы, «на которые знает ответ только семья», но модель не поддалась и снова вернулась к венчурному мошенничеству. «Я не помню, чтобы рожала вас двоих», пошутила она после теста.
Ожидание универсального собеседника. Интерактивный аватар Synthesia детерминирован: он отвечает только по загруженному материалу. Если вы обучите его на одной статье, он не расскажет о вашей биографии или компании в целом.
Недооценка «зловещей долины». Друзья Базинет назвали аватар одновременно интересным и жутковатым. Голос интерактивной версии показался им менее похожим на оригинал, чем у персонального аватара. Учитывайте это, если планируете использовать цифровой аватар для клиентов.
Пропуск этапа согласия. Платформа требует подписанного разрешения. Без него аватар не создадут, и это важно помнить, если вы делаете аватар сотрудника или партнёра.
Путаница между типами аватаров. Персональный аватар только читает скрипт. Интерактивный ведёт диалог. Для обучения сотрудников нужен второй, для промороликов хватит первого.
Что делать с этим прямо сейчас?
Авторам Дзена. Цифровой аватар может стать форматом для канала: вместо текстовой рубрики «ответы на вопросы» запишите интерактивное видео с аватаром, обученным на ваших лучших статьях. Пока Synthesia работает на английском языке, для русскоязычного контента стоит следить за локальными решениями.
Маркетологам. Synthesia уже предлагает продукт Roleplay Sessions: сотрудники тренируют, например, продающие презентации с интерактивным аватаром, который оценивает ответы. Это готовый инструмент для отдела обучения.
Предпринимателям в РФ и СНГ. Synthesia доступна через веб-интерфейс, ограничений по региону компания публично не объявляла. Из российских платформ, работающих с видеоаватарами, можно посмотреть на сервисы, использующие модели от Сбера или Яндекса, хотя прямых аналогов с интерактивными аватарами такого уровня на русском рынке пока нет.
Честно: цифровой аватар сегодня вызывает у людей смешанные чувства, от восторга до лёгкой жути. Базинет это подтвердила на своих друзьях и семье. Я считаю, что для бизнес-задач, обучения, типовых ответов клиентам, демонстрации продукта, технология уже рабочая. Для журналистики и экспертного контента пока рано: как справедливо замечает сама Базинет, главная валюта в медиа это доверие, а его нельзя передать алгоритму. Если вы планируете внедрять аватары, начните с простого: персональный аватар для внутренних видео. Интерактивный подключайте, когда точно знаете, на какой базе знаний он будет работать, иначе вместо помощника получите бота, который раздражает пользователей отказами отвечать.
Попробуйте генератор контент-планов dzen.guru
Спланируйте серию публикаций с использованием новых форматов, включая видео с аватарами, прямо в нашем бесплатном планировщике.
Создать контент-планПока технология говорит в основном по-английски и стоит ощутимых денег, но скорость, с которой Synthesia масштабируется (от стартапа до оценки в 4 млрд долларов за несколько лет, по данным TechCrunch), говорит о том, что русскоязычные интерактивные аватары появятся быстрее, чем кажется, и те, кто разберётся в механике сейчас, получат фору.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Малые модели ИИ ошибаются в 94% уверенности: solvi 0.5.0 отдаёт решения коду
Начну с анализа источника. Это авторский пост создателя открытой Python-библиотеки solvi (версия 0.5.0, лицензия Apache-2.0). Библиотека разделяет работу:…
Что такое ИИ-агент, когда он взламывает чужие системы: закон не знает, с кого спросить
ИИ-агенты взламывают чужие системы, а закон не знает, с кого спросить: серия инцидентов с моделями OpenAI, Anthropic и Google обнажила пробелы в…

Что такое галлюцинации нейросетей: три слоя проблемы, которую вы не замечаете
Галлюцинации нейросетей кажутся безобидными опечатками, пока модель не выдаёт несуществующую научную статью с правдоподобным названием, реальным журналом и…
Комментарии