Аудио → видео

Видео и говорящие аватары, ведомые звуковой дорожкой. В подборке 9 моделей: Kling Avatar 2.0 Pro, Kling Avatar 2.0 Standard, OmniHuman 1.5, Seedance 2.0 Mini, Seedance 2.5, Wan 3.0. Запуск онлайн из браузера, оплата за результат.

9 моделей
KKling Avatar 2.0 Pro — пример работы модели KwaiVGIKling Avatar 2.0 ProОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком повышенного качества. Опциональный промпт задаёт поведение. Тариф Pro. KKling Avatar 2.0 Standard — пример работы модели KwaiVGIKling Avatar 2.0 StandardОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком. Опциональный промпт задаёт поведение. Тариф Standard. O ByteDanceOmniHuman 1.5OmniHuman 1.5 от ByteDance — говорящий аватар: оживляет портрет по аудио (липсинк). SSeedance 2.0 Mini — пример работы модели ByteDanceSeedance 2.0 MiniЛёгкая версия Seedance 2.0 от ByteDance: видео по тексту, кадрам и мультимодальным референсам, 480p/720p, 4–15 секунд. Самая доступная точка входа в видеогенерацию. SSeedance 2.5 — пример работы модели ByteDanceSeedance 2.5Seedance 2.5 от ByteDance — видео по тексту, первому кадру и мультимодальным референсам, с синхронным аудио. WWan 3.0 — пример работы модели Alibaba GroupWan 3.0Wan 3.0 от Alibaba — видео по тексту, по первому кадру или по референсным изображениям, со звуком. Длительность 2–30 секунд, разрешение 480p/720p/1080p; цена считается за секунду и зависит от разрешения. WWan 3.0 Prime — пример работы модели Alibaba GroupWan 3.0 PrimeWan 3.0 Prime от Alibaba — тот же набор возможностей, что у Wan 3.0, но заметно быстрее и дороже за секунду. Длительность 2–30 секунд, разрешение 480p/720p/1080p. SSeedance 2 — пример работы модели ByteDanceSeedance 2Мультимодальная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Цена зависит от разрешения, соотношения сторон, длительности и наличия референсных видео. SSeedance 2 Fast — пример работы модели ByteDanceSeedance 2 FastУскоренная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Быстрее и дешевле standard-tier, без 1080p.

Нейросети для задачи «Аудио → видео»

Видео и говорящие аватары, ведомые звуковой дорожкой. Сейчас в подборке 9 моделей: Kling Avatar 2.0 Pro, Kling Avatar 2.0 Standard, OmniHuman 1.5, Seedance 2.0 Mini, Seedance 2.5, Wan 3.0, Wan 3.0 Prime, Seedance 2.

Все модели запускаются на aiRetry прямо в браузере, без установки и без подписки: цена видна в форме до запуска, списание проходит за завершённую генерацию. Те же модели доступны по HTTP API и через MCP-сервер для ИИ-агентов.