Как сделать говорящее фото нейросетью: пошаговый гайд【2026】
🎁 +100% к первому пополнению — доступ ко всем моделям--:--:--Забрать бонус →
D-ID Обзор — говорящие фото и видео-аватарыкаталог · без VPN · оплата картой РФ

Как сделать говорящее фото: пошаговая инструкция

Технология простая только на первый взгляд: между «получилось живо» и «получилась говорящая маска» стоит правильный исходник и понимание того, как модель работает с лицом.

Чтение: 8 минутОбновлено: 4 августа 2026

Что нужно на входе

Для говорящего портрета нужны две вещи: сам снимок и то, что человек должен произнести — текст для синтеза речи или готовая аудиозапись.

Аудио даёт более естественный результат: модель подстраивает артикуляцию под живую интонацию. Синтез удобнее, когда нужно быстро проверить сценарий или озвучить на другом языке.

Путь от снимка до говорящего видео1Портретанфас, ровный свет2Речьтекст или своё аудио3Генерациясинхронизация губ и мимики4Проверкасмотреть на 100 процентов

Требования к фотографии

Модель анимирует то, что видит. Чем меньше ей приходится домысливать, тем достовернее результат.

Каким должен быть исходный портретЛицо анфас, отклонение не больше 15 градусовРовный рассеянный свет, без жёстких теней на лицеОткрытый рот не обязателен, но губы должны быть видныБез очков с бликами и головных уборов, закрывающих лобРазрешение от 1000 пикселей по короткой стороне

Выбор сервиса под задачу

Ниша разделилась на три группы. Коммерческие сервисы дают лучшее качество артикуляции, открытые модели — бесплатны и приватны, мобильные приложения — быстрее всего, но с водяными знаками.

Два основных сервиса нишиD-IDHedraАртикуляцияэталоннаявысокаяМимикагубы и лёгкое движениевсё лицоДлина роликаминутыминутыЦена задачи≈35 ₽≈32 ₽Бесплатный режимпробные минутыпробные кредиты

Пять типичных ошибок

  • Профильный снимок — модель не видит вторую половину лица и достраивает её неудачно.
  • Групповое фото — сервис выберет одно лицо, часто не то, которое нужно.
  • Шумное аудио — артикуляция сбивается, появляются лишние движения рта.
  • Слишком длинный текст — на длинной реплике мимика начинает повторяться.
  • Мелкий или мутный снимок — зона губ выходит размытой.
Практика: начните с 15–20 секунд речи. Такой ролик генерируется быстро, и по нему сразу видно, годится ли исходник.

Сделать говорящее фото без VPN

≈35 ₽ за ролик

Модель D-ID, Hedra и ещё 49 сервисов на одном балансе.

  • Без VPN — модели открываются с российского адреса
  • Оплата картой РФ, для юрлиц счёт и закрывающие
  • Старт без карты: стартового баланса хватает на первые задачи
Начать бесплатно →

Регистрация 40 секунд · карта не нужна

Частые вопросы по теме

Сколько стоит говорящее фото?

Через общий баланс — около 35 ₽ за ролик вместо подписки от $5,90 в месяц.

Можно ли сделать бесплатно?

Да: Vidnoz даёт короткие ролики с водяным знаком, SadTalker работает бесплатно локально.

Поддерживается ли русский?

Да, артикуляция подстраивается под русскую речь.

Можно ли использовать чужое фото?

Только с согласия человека: публикация говорящего видео с чужим лицом нарушает закон о защите изображения гражданина.

Что лучше — свой голос или синтез?

Своё аудио даёт более живую мимику, синтез удобнее для быстрых тестов и других языков.

Из статьи

Сервисы, о которых шла речь

Выбор редакции
D-IDГоворящее фото и аватары4.6

Эталон ниши: фотография начинает говорить с точной артикуляцией — достаточно снимка и текста или аудио.

Блокирует РФВ общем доступе
≈35 ₽ за роликофициально: от $5,90/мес
Характеристики
Задача
Говорящее фото и аватары
На общем балансе
≈35 ₽ за ролик
Официально
от $5,90/мес
Доступ из РФ
Блокирует РФ
HedraЖивая мимика портрета4.4

Оживляет портрет с выразительной мимикой: работают не только губы, но и брови, взгляд, наклоны головы.

Блокирует РФВ общем доступеЕсть бесплатный тариф
≈32 ₽ за роликофициально: бесплатный лимит, от $10/мес
Характеристики
Задача
Живая мимика портрета
На общем балансе
≈32 ₽ за ролик
Официально
бесплатный лимит, от $10/мес
Доступ из РФ
Блокирует РФ
Vidnoz AIАватары и говорящие фото3.6

Недорогая платформа с аватарами, говорящими фото и синтезом речи — есть щедрый бесплатный тариф.

Блокирует РФВ общем доступеЕсть бесплатный тариф
≈30 ₽ за роликофициально: бесплатный лимит, от $19,90/мес
Характеристики
Задача
Аватары и говорящие фото
На общем балансе
≈30 ₽ за ролик
Официально
бесплатный лимит, от $19,90/мес
Доступ из РФ
Блокирует РФ
SadTalkerОткрытый липсинк3.5

Открытая модель, которая заставляет фото говорить: запускается локально, бесплатно и без ограничений.

Работает из РФЕсть бесплатный тариф
бесплатно, локальноофициально: бесплатно
Характеристики
Задача
Открытый липсинк
На общем балансе
бесплатно, локально
Официально
бесплатно
Доступ из РФ
Работает из РФ
ElevenLabsСинтез и клон голоса4.7

Лучший синтез речи на рынке: естественная интонация, клонирование голоса и дубляж на 30 языках.

Блокирует РФВ общем доступеЕсть бесплатный тариф
≈2 ₽ за минуту речиофициально: бесплатный лимит, от $5/мес
Характеристики
Задача
Синтез и клон голоса
На общем балансе
≈2 ₽ за минуту речи
Официально
бесплатный лимит, от $5/мес
Доступ из РФ
Блокирует РФ
Открыть модели из статьибез VPN · оплата картой РФ
Начать