ИИ для создания видео: самоучитель с нуля по шести ступеням

Учиться делать видео с ИИ удобнее по ступеням, а не по списку моделей: каждая следующая задача добавляет одну новую переменную, и становится видно, что именно сломалось, если результат не тот. Первый запуск — по готовому сюжету со своим снимком, последний — ролик из нескольких сцен с речью.

Создать видео с ИИ

Результат за минуту · Есть бесплатные шаблоны

Ниже шесть таких ступеней. На каждой — что нажать, сколько это стоит и по какому признаку понять, что можно идти дальше. Модели по ходу называются, но выбирать их с нуля не придётся: в шаблонах они уже подобраны.

  • Ступень 1. Оживить собственное фото

    Начинают с готового сюжета оживления: загружаете портрет, ничего не описываете, через минуту получаете пять секунд движения. Здесь одна переменная — ваш снимок, поэтому именно тут видно, какие фото модель любит: лицо крупно, ровный свет, без очков с бликами. Ошибка новичка — тёмное селфи из машины; результат сразу подскажет, что переснять.

  • Ступень 2. Шаблон, где вы в кадре

    Вторая переменная — сцена. Сюжеты вроде трансляции матча или встречи с белым медведем ставят человека в готовую обстановку по одному референсу. Проверять стоит две вещи: узнаваемость лица в движении и то, как сцена держит одежду и причёску. Если лицо плывёт, референс слишком мелкий — берут кадр, где голова занимает треть высоты.

  • Ступень 3. Сцена по тексту без фотографии

    Дальше убираем снимок и оставляем описание. Пишется оно короткими утверждениями: кто в кадре, где, что делает, куда едет камера. Прилагательные вроде «красиво» модель не переводит в картинку. Самая частая ошибка — пять действий в одной сцене длиной пять секунд: движение получается рваным. Одна сцена — одно действие, короткая проба обходится в пару звёзд.

  • Ступень 4. Звук и речь в кадре

    Звук приходит двумя путями: часть моделей генерирует шум и музыку вместе с картинкой, а реплику надёжнее записать отдельно голосом озвучки и свести с губами героя. Второй путь дороже на пару шагов, зато интонация живая, а фразу можно переписать, не пересобирая сцену. На этой ступени проверяют совпадение артикуляции и то, что русские ударения стоят где надо.

  • Ступени 5 и 6. Серия сцен и сборка ролика

    Последние ступени про постоянство: один герой в нескольких сценах держится референсом — первый удачный кадр загружают в каждую следующую генерацию, повторяя в описании одежду, свет и ракурс. Ролик длиннее десяти секунд собирают из таких сцен подряд, и каждая считается отдельно: сумма видна до запуска, короткая сцена — от пары звёзд, точное движение и высокое разрешение дороже.

Готовые шаблоны

Частые вопросы

Сколько стоит первая попытка создать видео с ИИ?

Стартовые звёзды нового аккаунта покрывают первые ступени самоучителя, а часть сюжетов открыта и вовсе без оплаты. Дальше цена сцены считается посекундно и видна до запуска.

Нужно ли уметь писать промты, чтобы начать?

На первых двух ступенях описание не нужно вообще — сюжет уже задан шаблоном. Текст появляется на третьей, и там достаточно трёх коротких фраз о том, что видно в кадре.

Можно ли пройти все ступени на телефоне?

Телефона достаточно: ступени проходятся в браузере, снимки берутся из галереи, а готовый ролик скачивается обычным mp4.

Ещё по теме