Липсинк по тексту
Пишете реплику — синтез речи и движение губ идут синхронно.
D-ID в России работает через AIR: нейросеть превращает портрет в говорящего человека — без VPN, с оплатой российской картой.
Бесплатный старт · отмена в один клик
D-ID и более 80 моделей в одном сервисе
ОткрытьD-ID — нейросеть формата talking head: она анимирует лицо на статичном портрете и синхронизирует губы с речью.
Пишете реплику — синтез речи и движение губ идут синхронно.
Загружаете аудиодорожку, модель подстраивает мимику под запись.
Фотография, иллюстрация или сгенерированный персонаж.
Оживают брови, взгляд и повороты головы, а не только рот.
Модели хватает статичного портрета, съемка не нужна.
Смена сценария — это перегенерация, а не новая смена.
D-ID в AIR
Напрямую сервис просит зарубежную карту и уводит расчеты в валюту. В AIR модель открывается после обычной регистрации: интерфейс на русском, оплата картами российских банков, а рядом в каталоге — генераторы изображений, где можно собрать персонажа для будущего аватара.
Формат раскрывается на трех типах исходника: живой диктор, эксперт в кадре и архивный портрет.
Промпт аватара состоит из двух частей: кто в кадре и как он держится. Опишите героя, план съемки и фон — и отдельно дайте текст, который он произносит.
«Девушка говорит прямо в камеру, естественная мимика и моргание, офис размыт на заднем плане».
Ровный фронтальный план и спокойная подача — базовый кадр для рассылок и лендингов.
«Мужчина в очках рассказывает в камеру и слегка жестикулирует, за ним размытый стеллаж с книгами».
Плечевой план с местом под жест; такой кадр читается как экспертное видео, а не как говорящая голова.
«Портрет пожилого мужчины в кресле: он медленно поворачивает голову к камере и моргает».
Минимум движения и максимум узнаваемости — жанр, с которого началась известность технологии.
Говорящий аватар закрывает задачи, где нужен человек в кадре, а съемка не окупается.
Обучение и онбординг
Преподаватель из одного фото ведет весь курс: уроки озвучиваются текстом, без студии и расписания смен. Онлайн-школы и HR-команды собирают десятки занятий силами одного методиста.
Реклама и продажи
Персонаж представляет продукт на лендинге, в рассылке или в таргете. Несколько версий сценария готовы за вечер — тест креативов перестает упираться в продакшн и бюджет.
Соцсети и шортсы
Стабильный поток говорящих роликов для Reels, Shorts и VK Клипов: один портрет, разные сценарии. Лицо канала всегда в форме и не зависит от чужого отпуска.
Ожившие архивные фото
Семейный портрет произносит поздравление, а музейный проект дает голос историческим снимкам. Механика, с которой началась известность D-ID, до сих пор стабильно собирает охваты.
Поздравления и личные ролики
Портрет коллеги читает тост на юбилей отдела, а нарисованный маскот компании объявляет о релизе. Это самый короткий путь попробовать формат: один портрет и три предложения текста.
Путь от фотографии до говорящего ролика — четыре шага, карта на старте не нужна.
Хватит email или Яндекс ID — без VPN, иностранного номера и зарубежной карты. Регистрация бесплатная.
Рядом — генераторы картинок: персонажа для аватара можно собрать тут же, не покидая кабинет.
Текст модель озвучит сама, а свою аудиодорожку синхронизирует по губам. Черновик сценария удобно набросать в чат-модели AIR — окно в соседней вкладке каталога.
Видео уходит в монтаж, презентацию или сразу в соцсети; неудачный дубль перегенерируется с уточненным текстом.
Озвучка — половина результата, и русский здесь — полноценный рабочий язык, а не перевод по остаточному принципу.
Карточка модели: кто делает D-ID и что подать на вход, чтобы получить живой ролик.
Три сервиса делают говорящие видео, но заходят с разных сторон — выбор зависит от задачи.
AIR отдает D-ID через OpenAI-совместимый эндпоинт: меняете baseURL и ключ — существующий код продолжает работать. Оплата — той же российской картой.
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.air.fail/v1",
apiKey: process.env.AIR_API_KEY,
});
const video = await client.post("/videos/generations", {
body: {
model: "d-id",
prompt: "Продуктовый ролик: флакон духов на подиуме, медленное вращение",
},
});
Тарификация привязана к роликам: длиннее видео и выше параметры — дороже генерация.
Free
0₽ в месяц
Что включено
Lite
990 ₽в месяц
Все из Free, плюс
Pro
Оптимальный2 990 ₽в месяц
Все из Lite, плюс
Max
9 990 ₽в месяц
Все из Pro, плюс
Да, через AIR: регистрация по email или Яндекс ID, генерация прямо в браузере. Зарубежные платформы, обходные схемы и иностранные номера не участвуют — оплата тоже проходит внутри, российскими картами.
Нет. AIR открывается из России напрямую — VPN не нужен ни для генерации, ни для оплаты. Единственное, что понадобится, — браузер и портрет.
Да, русская озвучка — штатный режим: пишете текст по-русски, модель читает его естественным голосом. Свою аудиодорожку тоже можно загрузить — губы синхронизируются под запись.
Портрет анфас с открытым лицом: фронтальный ракурс, ровный свет, без темных очков. Подходят фотографии, иллюстрации и сгенерированные персонажи — последних удобно собирать в соседних моделях каталога AIR. Если сомневаетесь, прогоните два-три варианта портрета и сравните липсинк на одном тексте.
Аватар говорит той дорожкой, которую вы загрузили, — модель отвечает только за губы и мимику. Используйте голоса, на которые есть право: свой, дикторский по договору или синтезированный.
Работайте с изображениями, правами на которые располагаете: свои снимки, съемка с разрешением модели, сгенерированные персонажи. Ответственность за исходники несет пользователь — это стандарт для всех подобных сервисов. Для коммерческих проектов надежнее всего сгенерированный персонаж: вопрос чужого лица не возникает вовсе.
Да, говорящие аватары давно живут в таргете, рассылках и на лендингах. Перед запуском проверьте права на портрет и аудио — остальное решает сценарий. Для теста удобно сгенерировать несколько версий ролика и оставить ту, которую кликают.
Начать можно бесплатно: регистрация в AIR не требует карты. Дальше — подписка или пакеты генераций; актуальный прайс показан в кабинете, цены в рублях.