Кадр → видео

Модели, которые оживляют готовый кадр: на вход изображение, на выходе видео. В подборке 35 моделей: Gemini Omni 1.1 Flash, Gemini Omni Flash, Grok Imagine Video 1.5, Happy Horse, Happy Horse 1.1, Kling 3.0 4K. Запуск онлайн из браузера, оплата за результат.

35 моделей
GGemini Omni 1.1 Flash — пример работы модели GoogleGemini Omni 1.1 FlashGemini Omni 1.1 Flash от Google — видео со встроенным звуком по тексту, по первому и последнему кадру или по референсным изображениям. Длительность 3–10 секунд, разрешение от 360p до 4K. GGemini Omni Flash — пример работы модели GoogleGemini Omni FlashМультимодальная видеогенерация Google: текст→видео и изображение→видео, длительность 4–10 секунд, до 4K. GGrok Imagine Video 1.5 — пример работы модели xAIGrok Imagine Video 1.5Видеогенерация xAI: текст или до 7 изображений на входе, 480p/720p, 1–15 секунд. HHappy Horse — пример работы модели Alibaba GroupHappy HorseAlibaba Happy Horse 1.0: text-to-video, image-to-video, reference-to-video, and video-edit in one card. The mode is chosen from the inputs you provide. HHappy Horse 1.1 — пример работы модели Alibaba GroupHappy Horse 1.1Happy Horse 1.1 от Alibaba: text-to-video, оживление кадра и референсы в одной карточке, 480p–1080p, 3–15 секунд. KKling 3.0 4K — пример работы модели KwaiVGIKling 3.0 4KKling 3.0 4K — нативное 4K-видео из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name. KKling 3.0 Motion Control — пример работы модели KwaiVGIKling 3.0 Motion ControlKling 3.0 Motion Control — перенос движения с reference-видео на reference-изображение с выбором ориентации и разрешения 720p/1080p. KKling 3.0 Pro — пример работы модели KwaiVGIKling 3.0 ProKling 3.0 Pro — Full HD-видео (1080p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name. KKling 3.0 Standard — пример работы модели KwaiVGIKling 3.0 StandardKling 3.0 Standard — HD-видео (720p) из текста или кадра с нативным аудио, мультикадровой режиссурой и элементами @name. KKling 3.0 Turbo Pro — пример работы модели KwaiVGIKling 3.0 Turbo ProБыстрый тир Kling 3.0 в Full HD (1080p): текст или кадр, мультишот до 15 секунд. Без нативного звука. KKling 3.0 Turbo Standard — пример работы модели KwaiVGIKling 3.0 Turbo StandardБыстрый тир Kling 3.0: HD-видео (720p) из текста или кадра, мультишот до 15 секунд. Без нативного звука — этим и дешевле. KKling Avatar 2.0 Pro — пример работы модели KwaiVGIKling Avatar 2.0 ProОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком повышенного качества. Опциональный промпт задаёт поведение. Тариф Pro. KKling Avatar 2.0 Standard — пример работы модели KwaiVGIKling Avatar 2.0 StandardОживляет портрет под аудио: по одному фото и аудиодорожке (2–60 сек) создаёт видео с реалистичным липсинком. Опциональный промпт задаёт поведение. Тариф Standard. KKling O3 4K — пример работы модели KwaiVGIKling O3 4KKling O3 4K — нативное 4K text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме. KKling O3 Pro — пример работы модели KwaiVGIKling O3 ProKling O3 Pro — более детальный text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме. KKling O3 Standard — пример работы модели KwaiVGIKling O3 StandardKling O3 Standard — text/image/reference-to-video с нативным аудио, multi-shot и элементами @name в reference-режиме. M MiniMaxMiniMax H3MiniMax H3 (Hailuo 03) — генерация видео по тексту и по первому кадру, нативное 2K. O ByteDanceOmniHuman 1.5OmniHuman 1.5 от ByteDance — говорящий аватар: оживляет портрет по аудио (липсинк). PPixVerse V6 — пример работы модели PixVersePixVerse V6PixVerse V6: пять видеорежимов в одной карточке — текст, кадр, первый+последний кадр, референсы и продление готового ролика; 360p–1080p. RRunway Gen-4.5 — пример работы модели RunwayRunway Gen-4.5Runway Gen-4.5 — генерация видео из текста с опциональным управлением по одному опорному кадру. SSeedance 2.0 Mini — пример работы модели ByteDanceSeedance 2.0 MiniЛёгкая версия Seedance 2.0 от ByteDance: видео по тексту, кадрам и мультимодальным референсам, 480p/720p, 4–15 секунд. Самая доступная точка входа в видеогенерацию. SSeedance 2.5 — пример работы модели ByteDanceSeedance 2.5Seedance 2.5 от ByteDance — видео по тексту, первому кадру и мультимодальным референсам, с синхронным аудио. SSora 2 — пример работы модели OpenAISora 2Генерация видео по тексту от OpenAI со синхронным звуком. SSora 2 Beta — пример работы модели OpenAISora 2 BetaБета-версия Sora 2: генерация видео со синхронным звуком и опциональный кадр-референс. Длительность 4/8/12 секунд, форматы 16:9 и 9:16. Фиксированная цена за клип. SSora 2 Pro — пример работы модели OpenAISora 2 ProГенерация видео по тексту от OpenAI со синхронным звуком и выбором разрешения. VVeo 3.1 Fast — пример работы модели GoogleVeo 3.1 FastGoogle Veo 3.1 Fast — быстрая генерация видео из текста и изображения с нативным звуком, разрешением до 4K и кадрами начала/конца. VVeo 3.1 Lite — пример работы модели GoogleVeo 3.1 LiteGoogle Veo 3.1 Lite — бюджетная генерация видео из текста и изображения с нативным звуком (720p; 1080p — только 8 секунд). VVeo 3.1 Quality — пример работы модели GoogleVeo 3.1 QualityGoogle Veo 3.1 Quality — премиальная генерация видео из текста, изображения, кадров начала/конца и референсов с нативным звуком и разрешением до 4K. VVidu Q3 — пример работы модели ViduVidu Q3Vidu Q3: видео из текста, кадров и референсов с апскейлом до 1440p, стили general/anime, до 16 секунд. Тиры turbo и pro. WWan 2.2 Animate (Move) — пример работы модели Alibaba GroupWan 2.2 Animate (Move)Wan 2.2 Animate от Alibaba оживляет изображение персонажа движением из видео-референса: переносит позы, жесты и мимику с исходного видео на вашего героя, сохраняя его внешность. Результат — анимированное видео 24 кадра/с. WWan 2.2 Animate (Replace) — пример работы модели Alibaba GroupWan 2.2 Animate (Replace)Wan 2.2 Animate (Replace) от Alibaba заменяет персонажа в исходном видео на персонажа с вашего изображения, сохраняя сцену, движение и освещение оригинала. WWan 3.0 — пример работы модели Alibaba GroupWan 3.0Wan 3.0 от Alibaba — видео по тексту, по первому кадру или по референсным изображениям, со звуком. Длительность 2–30 секунд, разрешение 480p/720p/1080p; цена считается за секунду и зависит от разрешения. WWan 3.0 Prime — пример работы модели Alibaba GroupWan 3.0 PrimeWan 3.0 Prime от Alibaba — тот же набор возможностей, что у Wan 3.0, но заметно быстрее и дороже за секунду. Длительность 2–30 секунд, разрешение 480p/720p/1080p. SSeedance 2 — пример работы модели ByteDanceSeedance 2Мультимодальная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Цена зависит от разрешения, соотношения сторон, длительности и наличия референсных видео. SSeedance 2 Fast — пример работы модели ByteDanceSeedance 2 FastУскоренная версия Seedance 2.0: text-to-video, image-to-video и reference-to-video в одной карточке. Быстрее и дешевле standard-tier, без 1080p.

Нейросети для задачи «Кадр → видео»

Модели, которые оживляют готовый кадр: на вход изображение, на выходе видео. Сейчас в подборке 35 моделей: Gemini Omni 1.1 Flash, Gemini Omni Flash, Grok Imagine Video 1.5, Happy Horse, Happy Horse 1.1, Kling 3.0 4K, Kling 3.0 Motion Control, Kling 3.0 Pro.

Все модели запускаются на aiRetry прямо в браузере, без установки и без подписки: цена видна в форме до запуска, списание проходит за завершённую генерацию. Те же модели доступны по HTTP API и через MCP-сервер для ИИ-агентов.