Нейросеть OmniHuman: говорящий аватар из фото
Лицо крупным планом, JPG или PNG
MP3, WAV, M4A или OGG, до 50 МБ — по ней строится речь
Белым — что менять, чёрным — что оставить
Пробная генерация · осталось 0 генераций
53 ₽ с подпиской · подробнее
Похожие нейросети
Ролики одним дублем без склеек, принимает текст, фото и звук сразу.
Реалистичное движение людей и физика объектов, ролики до 4K.
Кинематографичная картинка и ролики со звуком прямо из описания.
Плавное движение и точная композиция по доступной цене.
Цены по версиям
Возможности каждой версии и цена по всем трём тарифам рядом
| Версия | Возможности модели | Без подписки | Стандарт | ПРО |
|---|---|---|---|---|
| 1 Топ Новинка | Предыдущее поколение, дешевле | 83 ₽/5-секундное видео | 53 ₽/5-секундное видео | 49 ₽/5-секундное видео |
| 1.5 Новинка | Естественные жесты и движение всего человека в кадре | 111 ₽/5-секундное видео | 74 ₽/5-секундное видео | 69 ₽/5-секундное видео |
OmniHuman — что это за нейросеть
OmniHuman — модель ByteDance, которая делает из одной фотографии говорящее видео: движение губ, мимика и жесты строятся по приложенной звуковой дорожке. Версию 1.5 отмечают за естественность жестов и за то, что она не ограничивается лицом — в кадре двигается весь человек. Работает только в паре «фото + звук»: без дорожки модель не запускается.
Как работает OmniHuman
По фотографии строится модель человека в кадре.
Звуковая дорожка задаёт речь, мимику и жесты.
Описание помогает задать характер движения.
Как пользоваться
Приложите фото человека — крупным планом, лицо целиком.
Приложите звуковую дорожку с речью.
Опишите, как человек должен себя вести, если это важно.
Нажмите «Сгенерировать» — цена на кнопке уже учитывает вашу подписку.