OmniHuman 1.5
Здесь появится изображение, видео или текстовый ответ.
Запустите модель и следите за статусом без перезагрузки.
aiRetry
Здесь появится изображение, видео или текстовый ответ.
Запустите модель и следите за статусом без перезагрузки.
OmniHuman 1.5 от ByteDance — говорящий аватар: оживляет портрет по аудио (липсинк). Модель доступна на aiRetry: запуск онлайн из браузера, оплата по факту генерации, без подписки.
OmniHuman 1.5 от ByteDance — говорящий аватар: одно портретное изображение и аудиодорожка превращаются в видео, где губы, мимика и лёгкие жесты следуют за голосом, а не только за ритмом. Это не генерация сцены с нуля и не MiniMax H3: здесь главный вход — лицо (или персонаж) плюс речь. Модель понимает эмоцию в записи: паузы, вспышку, тихий тон. На портрете может быть человек, питомец или аниме-персонаж. Результат — видеоклип, длина почти совпадает с аудио.
Портрет — обязательное поле, одно изображение. Нужен ясный персонаж: лицо или верх тела, без толпы на переднем плане. Чем чище свет и крупнее лицо, тем устойчивее липсинк. Подойдёт фото, иллюстрация, кадр аниме — модель оживляет то, что на картинке, а не рисует нового героя.
Аудио — обязательное. Дорожка короче 60 секунд; для устойчивого результата лучше около 15 секунд. Чистая речь или пение без громкой музыки под голосом. Длина ролика следует за аудио: короткая фраза — короткий клип, длинный монолог — длиннее и дороже. Не обрезайте паузы «в ноль», если нужна живая интонация.
Разрешение — 720 или 1080, по умолчанию 1080. 1080 плотнее по кадру; 720 быстрее считается. На этой карточке цена идёт за секунду готового видео (то есть за длину аудио); разрешение выбирайте по тому, насколько важен финальный вид.
Промпт — необязательно. Короткий гайд по камере, жесту, настроению. Языки: китайский, английский, японский, корейский, испанский, индонезийский. Не переписывайте речь — её несёт аудио; в промпте лучше «смотрит в камеру, лёгкая улыбка, камера чуть ближе», чем новый текст реплики. Если оставить пустым, движение возьмётся из самой записи.
От чего зависит стоимость: оплата за секунду готового ролика, а секунды задаёт длина аудио. Чем длиннее дорожка, тем выше итог. Точную сумму в рублях показывает блок цены над кнопкой запуска.
Откройте страницу модели на airetry.ru, заполните форму и нажмите «Запустить»: параметры, подсказки и цена собраны на одной странице, результат появится там же. Подписка не нужна — списание идёт с баланса по факту генерации.
Запуск OmniHuman 1.5 стоит от 16 ₽ за запуск. Списывается только за завершённую генерацию, подписки и абонентской платы нет. Неудачная генерация не тарифицируется, деньги возвращаются на баланс.
Модель OmniHuman 1.5 разработана студией ByteDance. На aiRetry она доступна с готовой формой запуска и понятной ценой за генерацию.
OmniHuman 1.5 закрывает задачи: текст → видео, кадр → видео, аудио → видео. На выходе — видео.
Да. У aiRetry есть HTTP API (/openapi-docs/) и MCP-сервер (/mcp-docs/) — OmniHuman 1.5 запускается из кода или прямо из ИИ-агента вроде Claude, Cursor или Codex по тому же тарифу, что и в интерфейсе.
Каталог нейросетей · API · MCP для ИИ-агентов · Все модели ByteDance