Eera2.ai
-15%Тарифы
Eera2

Все нейросети в одном месте. Единая подписка, оплата в рублях.

Продукт

  • Главная
  • Текст
  • Изображения
  • Видео
  • Аудио
  • Агенты
  • Промпты
  • Блог
  • Тарифы

Компания

  • О нас
  • Поддержка
  • Telegram-канал

Юридическая информация

  • Пользовательское соглашение
  • Политика обработки персональных данных
  • Согласие на обработку персональных данных
  • Публичная оферта

ERA2.AI · ECOSYSTEM

Другие инструменты ERA2
  • ERA2 CardКарточки товаров для маркетплейсов
  • Live EraОживление фотографий в видео
  • ERA2 MusicГенерация музыки и вокала
  • ERA2 VoiceОзвучка текста нейросетью
  • ERA2 PartnerПартнёрская программа
E© 2026 era2.ai· ИП Волков Роман · ИНН 781316870193 · ОГРНИП 322784700274942v1.0.1
ТекстДизайнВидеоАудиоАгентыСообщество
ТекстЧат с ИИНаписать текстАнализ документовПеревод текстаНаписать кодГенерация идейПрезентацииChatGPT (OpenAI)Claude (Anthropic)Gemini (Google)Grok (xAI)DeepSeekPerplexityQwen (Alibaba)
ДизайнАнализ изображенияСделать ИИ-фотоРедактор фотоУдалить фонУдалить объектУлучшить качествоЗамена лицаNano BananaSeedreamFluxGPT ImageIdeogramQwenReve
ВидеоСоздать видеоОживить фотоВидео по двум кадрамВидео из видеоВидео редакторИИ АватарУлучшить качествоKlingSeedanceVeoSoraHailuoGrokHedraRunway
АудиоСоздать песнюТекст песниОзвучка текстаСоздание звуковУбрать вокалКавер песниФоновая музыкаElevenLabsSuno
АгентыМаркетологКопирайтерПрограммистПереводчикЮристГенерация идейChatGPT (OpenAI)Claude (Anthropic)Gemini (Google)Grok (xAI)DeepSeekPerplexityQwen (Alibaba)

Говорящее фото: портрет заговорит вашим голосом

Загрузите портрет и дайте голос: своё аудио или написанный текст. Нейросеть подгонит артикуляцию под звук, и человек на снимке заговорит. Панель работает онлайн, на русском.

ИИ Аватар
Модель
Изображение *

JPEG, PNG или WEBP · до 25 МБ · одно лицо в кадре

Звук *

MP3, WAV, OGG, M4A, AAC или FLAC · до 64 МБ

0 / 2000
Спишется за секунду видеоот 25 кр

Столько, сколько длится ваша дорожка. HeyGen произносит написанный текст, остальным нужен файл со звуком.

Четыре разных портрета подряд заговаривают на камеру: кот в панаме и очках, девушка в салатовой шапке, светящаяся фигура на чёрном фоне и пара на крыше в сумерках

Один запуск: снимок и дорожка на входе, говорящий ролик на выходе

Кадры, из которых получается говорящее фото

Женщина в деловом костюме держит флакон косметики и говорит на камеру, рот приоткрыт на полуслове
Женщина в деловом костюме держит флакон косметики и говорит на камеру, рот приоткрыт на полуслове.
Рисованная трёхмерная девушка в профиль, тёмные волосы собраны, улыбается на полуслове
Рисованная трёхмерная девушка в профиль, тёмные волосы собраны, улыбается на полуслове.
Молодой человек с голубыми волосами говорит на камеру на фоне груды денег
Молодой человек с голубыми волосами говорит на камеру на фоне груды денег.

Кому нужно говорящее фото

Старое фото из семейного архива
Отсканированный портрет прабабушки произносит поздравление её же голосом с диктофонной записи. Скан нужен чёткий, анфас.
Урок и презентация
Преподаватель начитывает материал, а в кадре говорит его фотография. Поправить текст можно без пересъёмки: меняется аудио.
Карточка товара и соцсети
Продавец голосом объясняет, чем товар отличается. Говорящее фото держит внимание в ленте соцсети дольше картинки.
Рисованный персонаж
Иллюстрация или трёхмерный герой оживают так же, как фотография: модель ищет лицо, не человека.

Как заставить фото говорить за 3 шага

  1. Шаг 1

    Загрузите портрет

    Панель принимает JPEG, PNG и WEBP. Лицо крупно и анфас: боковой ракурс, тёмный кадр и двух человек рядом модель разбирает хуже.

  2. Шаг 2

    Дайте голос

    Своё аудио кладите во второй слот: MP3, WAV, OGG, M4A, AAC или FLAC, до 64 МБ. Записи нет — HeyGen озвучит написанный текст сам.

  3. Шаг 3

    Заберите ролик

    Кнопка отдаёт MP4 с готовым липсинком. Длится он столько, сколько звучит дорожка.

По каким признакам видно хорошую синхронизацию

Губы попадают в звук

Смотрите на смыкание губ, а не на всё лицо. Согласные «п» и «б» требуют полного смыкания, и открытый рот в этот момент означает сбитую синхронизацию.

Мимика живёт целиком

Хороший результат двигает всё лицо. Брови и веки работают вместе с речью; лицо, где шевелится только челюсть, читается маской.

Черты не плывут к концу

Длинная дорожка нагружает модель сильнее короткой. Промотайте ролик в конец: расплывшийся нос и меняющийся оттенок кожи означают, что дорожку пора резать.

Форматы, длительность и цена

Что на входепортрет JPEG, PNG или WEBP и дорожка MP3, WAV, OGG, M4A, AAC или FLAC
Вес файловкартинка до 25 МБ, звук до 64 МБ
Что на выходеготовый MP4: говорящий портрет с синхронной артикуляцией
Длительность роликаравна длине дорожки, отдельной настройки нет
Разрешение480p у InfiniteTalk, 720p у Kling и Hedra, 1080p у OmniHuman
Ценаот 25 кредитов за секунду готового видео
Язык речилюбой: артикуляцию задаёт звук, а не язык текста
Чего не делаетне переозвучивает готовое видео

Что учесть перед запуском

Длительность задаёт дорожка: ролик идёт ровно столько, сколько записано речи. Выбора «5 или 10 секунд» у этих моделей нет. Цена поэтому посекундная: минута речи на Kling AI Avatar обойдётся в 3 900 кредитов. Чужой портрет берите только с согласия человека на снимке: ролик выглядит как настоящая запись, и выдавать его за неё нельзя.

HeyGen — Avatar IVHedra — Character-3

Какие нейросети делают ии-аватар и что просят на входе

Таблица листается вбок →

Kling AI AvatarHedra Character-3HeyGen Avatar IVInfiniteTalk
Что подать на входпортрет и готовая дорожкапортрет и готовая дорожкапортрет и текст, дорожка не обязательнапортрет и готовая дорожка
Сколько стоит65 кредитов за секунду65 кредитов за секунду80 кредитов за секунду25 кредитов за секунду
Когда выбиратьзапись голоса уже естькрупный план, где важны ровные губысвоей записи нет, реплику проще написатьсамый дешёвый запуск, 480p

Первым в панели стоит Kling AI Avatar. Модели делятся по входу, и от этого зависит порядок работы. Kling, Hedra, InfiniteTalk и OmniHuman берут готовую дорожку: без неё запуск не начнётся. HeyGen Avatar IV озвучивает текст сам.

Можно ли озвучить портрет бесплатно

Сколько дают на входе150 кредитов на счёт сразу после регистрации
На что хватитшесть секунд говорящего портрета на InfiniteTalk в 480p
Дальшеот 575 кредитов за секунду готового ролика
Чем платятрублями: картой или переводом по СБП, без зарубежной карты
Чего тут нетбезлимита: посекундный счёт на всех тарифах

Бесплатный старт конечен, и цифру вы знаете заранее. Сто пятьдесят кредитов приходят один раз после регистрации, карту никто не спрашивает. Хватает их на шесть секунд видео на InfiniteTalk.

Что делать, если губы не попали в звук

Что видно в результатеПричинаЧто сделать
Кнопка запуска не нажимаетсявыбрана модель, которой дорожка обязательнаприкрепите звук или возьмите HeyGen Avatar IV: он произносит текст
Видео не сгенерировалосьв дорожке шум, музыка или эхоOmniHuman 1.5 требует чистой разборчивой речи; перезапишите голос без фона
Списалось больше кредитов, чем думалисчёт идёт за секунду видеоумножьте длину дорожки на цену модели
Губы шевелятся, а лицо нетпортрет снят в профиль или лицо мелкоевозьмите кадр анфас, где лицо занимает треть высоты

Соседние инструменты для лица и голоса

Оживить фото
Движение в кадре без речи: поворот головы и взгляд
ИИ-фото по своему кадру
Аватарка для профиля: неподвижная картинка, не видео
HeyGen
Страница модели: Avatar IV и III, лимиты вендора
Hedra
Character-3 отдельной страницей: чем его липсинк отличается

Вопросы про говорящее фото

Если у вас возникли сложности, обратитесь в службу заботы

✈ Написать в поддержку

Загрузите портрет и дорожку с речью, нажмите запуск. Заставить фото говорить можно за один проход: модель разложит звук на фонемы и подгонит под них форму рта.

Выберите HeyGen Avatar IV и напишите реплику под загрузкой. Голос он синтезирует сам. Остальные модели без аудио не запускаются.

Регистрация нужна, карта нет. Стартовых 150 кредитов хватает на шесть секунд на InfiniteTalk в 480p.

Липсинк — совпадение движения губ со звуком. Технология слышит фонему и ставит рту нужную форму, кадр за кадром.

Анимация даёт движение без слов: поворот головы, взгляд, дыхание. Здесь движение губ подчинено дорожке, и без звука ничего не выйдет.

Только если человек на снимке дал на это согласие. Готовый ролик неотличим от настоящей съёмки, поэтому выдавать его за неё запрещено.

Дайте голос своему портрету
Попробовать бесплатно

Обновлено: 31.08.2026

  1. Главная
  2. Инструменты
  3. ИИ Аватар