Как доработать готовое видео нейросетью, не генерируя всё заново
Денис Коростелёв9 мин

Готовое видео нейросетью дорабатывают не «кнопкой исправить», а выбором одного из пяти приёмов: подать ролик на вход мультимодальной модели, перенести движение из него на новую картинку, продолжить сцену от последнего кадра, перерисовать стартовый кадр и сгенерировать заново только его, или просто поднять разрешение. Какой приём нужен, зависит от того, что именно сломано. А иногда правильный ответ — не дорабатывать вовсе, и ниже я покажу, как это понять до того, как вы потратите три попытки на спасение неудачного дубля.
Сразу оговорка: ни одна из доступных сейчас моделей не работает как видеоредактор с точечной правкой «замени кружку в руке на 3-й секунде». Любая доработка — это новая генерация, которая опирается на ваш материал. Поэтому часть исходника всегда перерисовывается, и к этому надо быть готовым.
Сначала диагноз: что именно не так
Прежде чем что-то запускать, посмотрите ролик покадрово и отнесите проблему к одной из четырёх категорий. Это экономит больше всего попыток.
Брак движения. Картинка хорошая, но персонаж двигается не так: рука проходит сквозь стол, походка деревянная, камера дёргается. Сюда же — когда вам нравится сцена, но нужна другая пластика.
Брак кадра. Движение нормальное, а внешний вид нет: не тот фон, лишний предмет, лицо «поплыло», текст на вывеске превратился в кашу. Проблема заложена ещё в первом кадре или появилась по ходу.
Не хватает длины. Всё хорошо, но сцена обрывается на полуслове, а монтажу нужно ещё несколько секунд.
Не хватает качества. Ролик целиком устраивает, но он мягкий, в низком разрешении и не выдерживает большой экран.
Если дефекты из разных категорий наложились друг на друга, чините их по одному, от самого грубого к самому тонкому. Апскейл всегда идёт последним: увеличивать ролик, который потом всё равно переделаете, бессмысленно. Типовые причины сбоев разобраны отдельно в статье почему видео выходит кривым, здесь же — что делать с уже полученным результатом.
Приём 1. Видео на входе в Gemini Omni
Gemini Omni — мультимодальная видеомодель Google, которая принимает на вход не только текст и картинки, но и видео, и выдаёт результат до 4K. В каталоге Most AI это единственная модель, которой можно отдать ролик как исходник и словами описать, что в нём поменять. Раздел видео из видео собран как раз под такие задачи.
Когда подходит: нужно сохранить общую композицию и ход сцены, но поменять стиль, свет, время суток, фон или добавить деталь. Сюда же — ваша собственная съёмка с телефона, которую хочется превратить в стилизованный кадр.
Когда не подходит: если нужна пиксельная точность. Модель пересобирает сцену целиком, и мелкие детали исходника (надписи, мимика, форма предметов) могут измениться. Проверяйте на коротком фрагменте, а не на всём ролике сразу.
Промт стоит строить по принципу «что сохранить + что изменить + чего не трогать»:
Исходное видео: человек идёт по набережной, камера сопровождает сбоку.
Сохрани траекторию движения, ракурс и темп камеры.
Измени: время суток на ранние сумерки, тёплые фонари вдоль набережной,
лёгкий туман над водой.
Не меняй одежду человека и его походку. Без текста и логотипов в кадре.
Чем конкретнее блок «сохрани», тем меньше модель импровизирует там, где вы этого не просили.
Приём 2. Перенос движения в Kling Motion Control
Kling Motion Control устроен наоборот: он берёт движение из референсного видео и переносит его на персонажа с одной фотографии. Исходно инструмент задуман под трендовые танцы, но работает и для любой выразительной пластики.
Когда подходит: у вас есть удачное движение, но неудачная картинка. Например, дубль с правильным жестом ведущего, где сам ведущий нарисован плохо. Или ваш собственный ролик, где вы сами показываете движение, а в кадре должен быть рисованный персонаж. Вы готовите хорошее фото героя, подаёте ролик как источник движения — и получаете новое видео с той же пластикой.
Ограничения стоит держать в голове. Референс должен быть читаемым: один человек в кадре, тело видно целиком или хотя бы до пояса, без резких перекрытий. Пропорции героя на фото и человека в референсе не должны отличаться радикально, иначе движение ляжет криво. И главное: если в референсе чужой человек или вы берёте чьё-то фото, нужно согласие этого человека. Лица знаменитостей и чужих блогеров в эту схему лучше не подставлять вовсе.
Приём 3. Продолжение от последнего кадра
Самый недооценённый способ удлинить сцену. Логика простая: берёте последний кадр удачного ролика, сохраняете его как картинку и запускаете генерацию из изображения в видео с этим кадром в роли стартового. Новый отрезок начинается ровно там, где закончился старый, и при склейке шов почти незаметен.
Практические детали, которые решают исход:
- Берите не самый последний кадр, а тот, где нет смаза. Под конец ролика движение иногда размывается или картинка «замирает», и такой старт даст мутное начало второго отрезка.
- В промте продолжения описывайте только следующее действие, а не всю сцену заново. Модель уже видит обстановку на картинке.
- Используйте ту же модель, что и для первого отрезка. Разные модели по-разному передают цвет и зерно, и шов станет заметен.
- Звук в двух отрезках, сгенерированный отдельно, почти наверняка не совпадёт. Если ролик озвучен, проще снять звук с обоих кусков и положить единую дорожку при монтаже.
Пример промта для второго отрезка:
Продолжение сцены. Девушка ставит чашку на подоконник, поворачивается
к камере и улыбается. Камера медленно отъезжает назад.
Свет, цвет и обстановка — как на исходном кадре. Движение плавное, без рывков.
Так можно наращивать сцену несколькими шагами, но каждый шаг немного сдвигает внешность героя. После двух-трёх продолжений сравните первый и последний кадр рядом: если лицо заметно ушло, вернитесь к исходному кадру и перезапустите цепочку от него.
Приём 4. Правка стартового кадра в Nano Banana 2
Если брак кадра заложен с самого начала, чинить видео бесполезно — нужно чинить картинку, из которой оно выросло. Берёте первый кадр (свой исходник или стоп-кадр из ролика), правите его в Nano Banana 2 и заново оживляете уже исправленную версию.
Nano Banana 2 хорошо справляется с точечными правками по тексту: убрать лишний предмет, поменять фон, исправить руки, переодеть героя, выровнять свет. Промт тут строится как задание ретушёру:
На изображении: мужчина за столом в кафе.
Убери бумажный стакан слева на столе и телефон у локтя.
Замени фон за окном на заснеженную улицу, сохранив мягкий дневной свет.
Лицо, позу и одежду мужчины не меняй.
Затем исправленный кадр идёт в ту же видеомодель с тем же промтом движения, что и в удачном дубле. Движение получится не идентичным — это новая генерация, — но характер сцены обычно сохраняется, если промт движения не меняли.
Этот же приём спасает, когда дефект появляется не в начале, а в середине: найдите последний «чистый» кадр перед поломкой, поправьте его при необходимости и продолжите сцену от него, как в приёме 3. Испорченный хвост просто отрежете при монтаже.
Приём 5. Апскейл готового ролика
Когда ролик устраивает целиком, но он в 720p или 768p, а нужно больше — подойдёт готовый инструмент «Увеличить размер видео». Он поднимает разрешение до 4K и сохраняет исходную длительность, без промта и без перегенерации сцены.
Важно понимать границы. Апскейл дорисовывает детализацию, но не исправляет содержание: кривая рука станет кривой рукой в высоком разрешении. Поэтому этот шаг — финальный, после всех остальных правок. Если ролик собран из нескольких отрезков, сначала смонтируйте их, а увеличивайте уже готовую склейку: так все куски получат одинаковую обработку и не будут отличаться по резкости.
Когда дешевле перегенерировать
Доработка — это тоже платные генерации, и иногда их сумма превышает стоимость пары новых попыток с нуля. Прикидывать удобно в запусках: сколько генераций уйдёт на спасение дубля и сколько — на новый с нуля. Как считать стоимость секунды и бюджет ролика целиком, разобрано в статье про стоимость секунды ИИ-видео, а актуальные цены по моделям — на странице тарифов.
| Ситуация | Что разумнее |
|---|---|
| Сцена удачная, не хватает нескольких секунд | Продолжение от последнего кадра |
| Движение хорошее, внешний вид плохой | Kling Motion Control или правка стартового кадра |
| Композиция нравится, нужен другой стиль или свет | Видео на входе в Gemini Omni |
| Всё устраивает, кроме разрешения | Апскейл |
| Испорчено больше половины ролика | Перегенерация |
| Промт описывал не ту сцену | Перегенерация с новым промтом |
Несколько признаков, что пора бросать доработку:
- Вы исправляете третий дефект подряд в одном и том же отрезке. Значит, проблема в исходном промте или картинке, а не в конкретном дубле.
- Модель стабильно ломает одно и то же место. Лучше попробовать другую модель, чем в пятый раз просить эту.
- Продолжение уже дважды увело внешность героя. Цепочка накопила ошибку, и её дешевле начать заново от эталонного кадра.
- Вы не можете сформулировать, что именно хотите изменить. Тогда любая доработка — это та же лотерея, что и новая генерация, только сложнее.
Условный сценарий для иллюстрации. Нужен восьмисекундный ролик для карточки товара. Первый дубль вышел с хорошим движением камеры, но на третьей секунде упаковка «перетекает» в другую форму. Доработать можно так: взять кадр до поломки, продолжить от него — это одна-две генерации. Но если форма упаковки «плывёт» с первой секунды, значит, модель не держит этот предмет, и честнее перегенерировать с более чётким стартовым кадром или сменить модель.
Частые вопросы
Можно ли поправить одну деталь в видео, не трогая остальное?
Точечного редактирования в смысле «замени только этот предмет» у видеомоделей сейчас нет: любая правка — это новая генерация на основе вашего материала. Ближе всего к этому правка стартового кадра с последующим оживлением или подача ролика на вход Gemini Omni с жёстким списком того, что сохранить. Мелкие детали при этом всё равно могут измениться.
Подойдёт ли своя съёмка с телефона в качестве исходника?
Да, для переноса движения и для подачи видео на вход своя съёмка подходит. Снимайте при ровном свете, без резких движений камеры и так, чтобы объект был хорошо виден. Если в кадре другие люди, берите такой ролик в работу только с их согласия.
Как склеить продолжение с исходным роликом без заметного шва?
Стартуйте продолжение с чёткого кадра без смаза, используйте ту же модель и не переописывайте обстановку в промте. Звук обоих отрезков лучше заменить общей дорожкой при монтаже. Цветовую разницу, если она осталась, выравнивают в монтажной программе.
Улучшит ли апскейл неудачную генерацию?
Нет. Инструмент «Увеличить размер видео» повышает разрешение до 4K и добавляет детализацию, но не исправляет ошибки в движении, форме или анатомии. Запускайте его последним, когда содержание ролика вас полностью устраивает.
Сколько раз можно продолжать сцену от последнего кадра?
Жёсткого ограничения нет, но с каждым шагом внешность героя и обстановка немного смещаются. После двух-трёх продолжений сравнивайте начальный и текущий кадр. Если расхождение заметно, перезапускайте цепочку от эталонного кадра.
Какую модель брать для продолжения, если исходник сделан в другом сервисе?
Любую видеомодель из каталога, которая оживляет изображение, — стартовый кадр для неё просто картинка. Но шов между отрезками разных моделей будет заметнее из-за разной передачи цвета и зерна. Если важна бесшовность, сделайте короткий тестовый отрезок и сравните стык до того, как продолжать всю сцену.
Итог короткий: сначала назовите дефект, потом выбирайте приём под него, а апскейл оставляйте на самый конец. И заранее решите для себя порог, после которого вы перестаёте спасать дубль и запускаете новую генерацию — это самая дешёвая привычка в работе с ИИ-видео.
Осталось собрать на своём кадре
Повторите разобранное в кабинете: приложите фото или опишите сцену — и получите готовый ролик без монтажной программы.



