Кадр → видео
Модели, которые оживляют готовый кадр: на вход изображение, на выходе видео. В подборке 35 моделей: Gemini Omni 1.1 Flash, Gemini Omni Flash, Grok Imagine Video 1.5, Happy Horse, Happy Horse 1.1, Kling 3.0 4K. Запуск онлайн из браузера, оплата за результат.
35 моделей
G
GoogleGemini Omni 1.1 FlashGemini Omni 1.1 Flash от Google — видео со встроенным звуком по тексту, по первому и последнему кадру или по референсным изображениям. Длительность 3–10 секунд, разрешение от 360p до 4K.
G
GoogleGemini Omni FlashМультимодальная видеогенерация Google: текст→видео и изображение→видео, длительность 4–10 секунд, до 4K.
G
xAIGrok Imagine Video 1.5Видеогенерация xAI: текст или до 7 изображений на входе, 480p/720p, 1–15 секунд.
H
Alibaba GroupHappy HorseAlibaba Happy Horse 1.0: text-to-video, image-to-video, reference-to-video, and video-edit in one card. The mode is chosen from the inputs you provide.
H
Alibaba GroupHappy Horse 1.1Happy Horse 1.1 от Alibaba: text-to-video, оживление кадра и референсы в одной карточке, 480p–1080p, 3–15 секунд.
K
KwaiVGIKling 3.0 4KKling 3.0 4K — нативное 4K-видео из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling 3.0 Motion ControlKling 3.0 Motion Control — перенос движения с reference-видео на reference-изображение с выбором ориентации и разрешения 720p/1080p.
K
KwaiVGIKling 3.0 ProKling 3.0 Pro — Full HD-видео (1080p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling 3.0 StandardKling 3.0 Standard — HD-видео (720p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling 3.0 Turbo ProБыстрый тир Kling 3.0 в Full HD (1080p): текст или кадр, мультишот до 15 секунд. Без нативного звука.
K
KwaiVGIKling 3.0 Turbo StandardБыстрый тир Kling 3.0: HD-видео (720p) из текста или кадра, мультишот до 15 секунд. Без нативного звука — этим и дешевле.
K
KwaiVGIKling Avatar 2.0 ProОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком повышенного качества. Опциональный промпт задаёт поведение. Тариф Pro.
K
KwaiVGIKling Avatar 2.0 StandardОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком. Опциональный промпт задаёт поведение. Тариф Standard.
K
KwaiVGIKling O3 4KKling O3 4K — нативное 4K text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
K
KwaiVGIKling O3 ProKling O3 Pro — более детальный text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
K
KwaiVGIKling O3 StandardKling O3 Standard — text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
M
MiniMaxMiniMax H3MiniMax H3 (Hailuo 03) — генерация видео по тексту и по первому кадру, нативное 2K.
O
ByteDanceOmniHuman 1.5OmniHuman 1.5 от ByteDance — говорящий аватар: оживляет портрет по аудио (липсинк).
P
PixVersePixVerse V6PixVerse V6: пять видеорежимов в одной карточке — текст, кадр, первый+последний кадр, референсы и продление готового ролика; 360p–1080p.
R
RunwayRunway Gen-4.5Runway Gen-4.5 — генерация видео из текста с опциональным управлением по одному опорному кадру.
S
ByteDanceSeedance 2.0 MiniЛёгкая версия Seedance 2.0 от ByteDance: видео по тексту, кадрам и мультимодальным референсам, 480p/720p, 4–15 секунд. Самая доступная точка входа в видеогенерацию.
S
ByteDanceSeedance 2.5Seedance 2.5 от ByteDance — видео по тексту, первому кадру и мультимодальным референсам, с синхронным аудио.
S
OpenAISora 2Генерация видео по тексту от OpenAI со синхронным звуком.
S
OpenAISora 2 BetaБета-версия Sora 2: генерация видео со синхронным звуком и опциональный кадр-референс. Длительность 4/8/12 секунд, форматы 16:9 и 9:16. Фиксированная цена за клип.
S
OpenAISora 2 ProГенерация видео по тексту от OpenAI со синхронным звуком и выбором разрешения.
V
GoogleVeo 3.1 FastGoogle Veo 3.1 Fast — быстрая генерация видео из текста и изображения с нативным звуком, разрешением до 4K и кадрами начала/конца.
V
GoogleVeo 3.1 LiteGoogle Veo 3.1 Lite — бюджетная генерация видео из текста и изображения с нативным звуком (720p; 1080p — только 8 секунд).
V
GoogleVeo 3.1 QualityGoogle Veo 3.1 Quality — премиальная генерация видео из текста, изображения, кадров начала/конца и референсов с нативным звуком и разрешением до 4K.
V
ViduVidu Q3Vidu Q3: видео из текста, кадров и референсов с апскейлом до 1440p, стили general/anime, до 16 секунд. Тиры turbo и pro.
W
Alibaba GroupWan 2.2 Animate (Move)Wan 2.2 Animate от Alibaba оживляет изображение персонажа движением из видео-референса: переносит позы, жесты и мимику с исходного видео на вашего героя, сохраняя его внешность. Результат — анимированное видео 24 кадра/с.
W
Alibaba GroupWan 2.2 Animate (Replace)Wan 2.2 Animate (Replace) от Alibaba заменяет персонажа в исходном видео на персонажа с вашего изображения, сохраняя сцену, движение и освещение оригинала.
W
Alibaba GroupWan 3.0Wan 3.0 от Alibaba — видео по тексту, по первому кадру или по референсным изображениям, со звуком. Длительность 2–30 секунд, разрешение 480p/720p/1080p; цена считается за секунду и зависит от разрешения.
W
Alibaba GroupWan 3.0 PrimeWan 3.0 Prime от Alibaba — тот же набор возможностей, что у Wan 3.0, но заметно быстрее и дороже за секунду. Длительность 2–30 секунд, разрешение 480p/720p/1080p.
S
ByteDanceSeedance 2Мультимодальная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Цена зависит от разрешения, соотношения сторон, длительности и наличия референсных видео.
S
ByteDanceSeedance 2 FastУскоренная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Быстрее и дешевле standard-tier, без 1080p.
Alibaba GroupHappy HorseAlibaba Happy Horse 1.0: text-to-video, image-to-video, reference-to-video, and video-edit in one card. The mode is chosen from the inputs you provide.
H
KwaiVGIKling 3.0 4KKling 3.0 4K — нативное 4K-видео из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling 3.0 Motion ControlKling 3.0 Motion Control — перенос движения с reference-видео на reference-изображение с выбором ориентации и разрешения 720p/1080p.
K
KwaiVGIKling 3.0 ProKling 3.0 Pro — Full HD-видео (1080p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling 3.0 StandardKling 3.0 Standard — HD-видео (720p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name.
K
KwaiVGIKling Avatar 2.0 ProОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком повышенного качества. Опциональный промпт задаёт поведение. Тариф Pro.
K
KwaiVGIKling Avatar 2.0 StandardОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком. Опциональный промпт задаёт поведение. Тариф Standard.
K
KwaiVGIKling O3 4KKling O3 4K — нативное 4K text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
K
KwaiVGIKling O3 ProKling O3 Pro — более детальный text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
K
KwaiVGIKling O3 StandardKling O3 Standard — text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме.
M
MiniMaxMiniMax H3MiniMax H3 (Hailuo 03) — генерация видео по тексту и по первому кадру, нативное 2K.
O
ByteDanceOmniHuman 1.5OmniHuman 1.5 от ByteDance — говорящий аватар: оживляет портрет по аудио (липсинк).
P
RunwayRunway Gen-4.5Runway Gen-4.5 — генерация видео из текста с опциональным управлением по одному опорному кадру.
S
OpenAISora 2Генерация видео по тексту от OpenAI со синхронным звуком.
S
OpenAISora 2 BetaБета-версия Sora 2: генерация видео со синхронным звуком и опциональный кадр-референс. Длительность 4/8/12 секунд, форматы 16:9 и 9:16. Фиксированная цена за клип.
S
OpenAISora 2 ProГенерация видео по тексту от OpenAI со синхронным звуком и выбором разрешения.
V
ByteDanceSeedance 2Мультимодальная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Цена зависит от разрешения, соотношения сторон, длительности и наличия референсных видео.
SНейросети для задачи «Кадр → видео»
Модели, которые оживляют готовый кадр: на вход изображение, на выходе видео. Сейчас в подборке 35 моделей: Gemini Omni 1.1 Flash, Gemini Omni Flash, Grok Imagine Video 1.5, Happy Horse, Happy Horse 1.1, Kling 3.0 4K, Kling 3.0 Motion Control, Kling 3.0 Pro.
Все модели запускаются на aiRetry прямо в браузере, без установки и без подписки: цена видна в форме до запуска, списание проходит за завершённую генерацию. Те же модели доступны по HTTP API и через MCP-сервер для ИИ-агентов.
