Академия Most-AI
Seedance как режиссёр: гайд по промптам, камере и кино-качеству
У Seedance вы не описываете «что происходит» — вы ставите кадр: крупность плана, движение камеры, источник света, порядок склеек. Разбираем три режима генерации, структуру промпта, язык камеры и то, что отличает «мыло» от кадра как из кино.

Почему это ближе к кино, чем к «генерации видео»
У большинства видео-нейросетей вы описываете «что происходит», и модель сама решает, как это снять. У Seedance наоборот — вы сами режиссёр и оператор: указываете крупность плана, тип движения камеры, на чём она фокусируется, откуда идёт свет и как чередуются кадры. Модель это честно исполняет.
Отсюда и разница в результате. Если писать промпт как «человек идёт по улице, драматично» — получится усреднённый ролик, где всё немного плывёт и ничем не запоминается. Если расписать сцену как режиссёр — с планами, монтажными склейками и мотивацией камеры — получится то, что действительно похоже на кадр из фильма или сериала.
Дальше в гайде — вся механика: три режима генерации, структура промпта, язык камеры и то, что отличает «дёшево» от «дорого» в картинке.
Три режима работы — и когда какой брать

Прежде чем писать сам промпт, важно понять, какую задачу вы решаете. Это три разных типа генерации, и промпт для каждого собирается по-своему.
Базовый режим: видео создаётся с чистого листа по текстовому описанию, либо с опорой на фото, видео или аудио-референсы (теги @Image, @Video, @Audio). Референс может задавать лицо персонажа, локацию, движение или звуковую дорожку — у каждого файла своя явная роль.
Берите этот режим, когда сцены ещё не существует и вы собираете её с нуля — рекламный ролик, сюжетная сцена, анимация персонажа по фото.

Вы задаёте два изображения — с чего ролик начинается и чем заканчивается — и Seedance сама выстраивает движение между этими двумя состояниями. Можно указать и больше двух опорных кадров подряд, тогда они зададут порядок стадий.
Берите, когда вам важен точный финальный кадр — например, для бесшовного перехода в следующую сцену, или когда нужно провести объект/персонажа из одной точной позы в другую.

У вас уже есть готовый ролик, и нужно нарастить его вперёд или назад — например, добавить, что было до сцены, или что происходит после последнего кадра. Новый сегмент подхватывает позу, свет, положение камеры и направление движения прямо с границы исходного видео.
Берите, когда работаете с уже отснятым (или сгенерированным) материалом и нужно его продлить, а не переснять заново.

Соотношение сторон и длительность в этих трёх режимах ведут себя по-разному. В обычной генерации их выставляют в интерфейсе. В режиме первого/последнего кадра формат фиксируется по первому изображению — так что оба опорных кадра должны быть в одинаковых пропорциях. В extension формат исходного видео наследуется автоматически.
Анатомия промпта

Хаотичный промпт даёт хаотичное видео. Рабочая структура — писать промпт как техническое задание оператору, по одной и той же схеме каждый раз:
SUBJECT — кто в кадре, совпадает с референсом на 100%. Цель и эмоциональный бит сцены одной строкой. LOCATION — место действия. Если это референс — задаёт настроение и архитектуру, а не жёсткий стоп-кадр. ACTION — суть сцены одной строкой, дальше тайминг по кадрам: [0:00–3s] что происходит, что делает камера [3:00–7s] следующий бит, камера меняется [7:00–15s] финал CAMERA — по каждому кадру: план, движение, на чём фокус, мотивация. STYLE — доминирующий цвет 60% / вторичный 30% / акцент 10%. Свет: откуда и почему. CONSTRAINTS — жёсткие правила: без рывков, устойчивое лицо, масштаб предметов, что остаётся неизменным.
SUBJECT — who is in frame, matches reference 100%. Goal and emotional beat in one line. LOCATION — where it happens. If this is a reference image — it sets mood and architecture, not a frozen frame. ACTION — the beat of the scene in one line, then timing per shot: [0:00–3s] what happens, what the camera does [3:00–7s] next beat, camera changes [7:00–15s] final beat CAMERA — per shot: framing, movement, focus target, motivation. STYLE — dominant color 60% / secondary 30% / accent 10%. Light: source and reason. CONSTRAINTS — hard rules: no jitter, stable face, prop scale, what must stay unchanged.
Такой шаблон работает и для 15-секундного, и для 30-секундного ролика — просто во втором случае в ACTION появляется больше сегментов тайминга.
Правило физики вместо эмоций
Seedance гораздо точнее считывает наблюдаемые физические детали, чем абстрактные чувства. Разница в двух строчках:
he looks angry, feels nervous
jaw clenches, nostrils flare, breath sharpens
left forearm rotates 45 degrees to block the punch
spinning back kick connects — намерение и результат, без точной биомеханики
Формула эмоционального бита: триггер → наблюдаемое поведение → реакция камеры или света. Например: «его оскорбляют → челюсть сжимается, взгляд сужается → камера чуть наезжает, фон размывается». Двух-трёх точных признаков достаточно, длинный список микровыражений модель просто не удержит.
Язык камеры

Это, пожалуй, самая недооценённая часть промпта. Камера у Seedance управляется отдельно от действия, и именно она превращает статичную сцену в кино.
Типы движения
Крупность плана — от общего к крупному
Сверхобщий → общий → средний → средне-крупный → крупный → сверхкрупный
Правило двойного контраста
Каждая склейка должна менять сразу два параметра одновременно — крупность плана и тип движения камеры. Если меняется только что-то одно, монтаж выглядит вялым и «плоским».
WS handheld → ECU static → MS crane → CU tracking
Хорошая последовательность склеек: каждый следующий кадр отличается от предыдущего и по масштабу, и по характеру движения
Формула для каждого кадра
Не пишите просто «camera moves» — модель должна знать, за чем следит камера. Рабочая формула: приём + объект в фокусе + стартовая позиция + направление движения + конечная точка.
Slow dolly-in, target: her face, starts at MS distance, moves forward, ends at CU — eyes fill the frame.
Как перестать снимать «мыло» и получить кадр как из Netflix

«Мыльный» ИИ-вид — это не одна конкретная ошибка, а сумма мелочей: слишком гладкая кожа, слишком ровный свет без мотивации, слишком плавное движение без веса и инерции, всё немного «пластиковое». Вот что реально меняет картинку.
Готовый блок стиля, который можно вставлять в начало любого промпта как основу и адаптировать под конкретную сцену:
Стиль: 8K, кинематографично. Фотореалистично — без 3D-рендера, без вида как в игровом движке. Свет: только естественный — контровой свет, ключевой свет из неба/окон. Цвет: 60:30:10 — доминирующий / вторичный / акцентный. Камера: физическая кинооптика. Смаз движения под 180° затвор. Кожа: реализм на уровне пор — пушковые волоски, асимметричные родинки, лёгкое покраснение капилляров. Физика: гравитация и инерция соблюдены, корректные контактные тени. Ничего не парит. Целостность: персонажи, предметы и окружение идентичны в каждом кадре. Звук: только окружающие шумы. Без музыки.
Style: 8K cinematic. Photorealistic — no 3D render, no game engine look. Lighting: natural light only — contre-jour backlight, key light from sky/windows. Color: 60:30:10 — dominant / secondary / accent. Camera: physical cine lens. 180° shutter motion blur. Skin: pore-level realism — vellus hair, asymmetric moles, capillary flush. Physics: gravity and inertia respected, correct contact shadows. No floating props. Continuity: characters, props and environment identical across every cut. Audio: environmental SFX only. No music.
Style Prefix — пишется один раз и добавляется в начало каждого промпта в проекте, чтобы все сцены держали одну стилистику
Разбор одного полного промпта
Собираем сцену: героиня заходит в тёмный кабинет, включает настольную лампу и садится за стол. 15 секунд, атмосфера — тихий напряжённый вечер.
Стиль: 8K, кинематографично. Фотореалистично — без 3D-рендера. Свет: только естественный + практический — настольная лампа как ключевой свет, окно как холодный контровой. Цвет: 60:30:10 — доминирующий тёмно-синий / вторичный тёплый янтарный / акцент белый блик. Камера: физическая кинооптика. Смаз движения под 180° затвор. Физика: гравитация и инерция соблюдены, реальные контактные тени. Звук: только окружающие шумы, без музыки. ГЕРОИНЯ — @hero, женщина в тёмном блейзере, совпадает с референсом на 100%. Цель: заходит в тихий кабинет ночью, одна, сосредоточена. Баланс белого 3200K. ЛОКАЦИЯ — @office, референс только для настроения, не жёсткий кадр. Тёмный деревянный стол, высокое окно, огни города снаружи. Героиня свободно движется в пространстве. ДЕЙСТВИЕ — [0:00–4s] Открывает дверь, заходит в тёмную комнату, замирает, осматривается. Жёсткая склейка. [4:00–9s] Идёт к столу, тянется к лампе, включает её — тёплый свет разливается по столу. Жёсткая склейка. [9:00–15s] Садится, выдыхает, руки на столе. Взгляд поднимается к окну. КАМЕРА — Кадр 1: общий план с рук, цель — силуэт в дверном проёме, следует за ней вперёд в комнату. Кадр 2: средний план, стабилизированное сопровождение, цель — рука на выключателе лампы, заканчивается светом на лице. Кадр 3: медленный наезд, цель — лицо, начало со среднего плана, финал крупным планом — огни города в глазах. ОГРАНИЧЕНИЯ — 16:9. Без замедления. Лицо стабильно на всех кадрах, без искажений. Одежда и направление света неизменны во всех трёх кадрах.
Style: 8K cinematic. Photorealistic — no 3D render. Lighting: natural + practical only — single desk lamp as key light, window as cool rim light. Color: 60:30:10 — dominant deep navy / secondary warm amber / accent white highlight. Camera: physical cine lens. 180° shutter motion blur. Physics: gravity and inertia respected, real contact shadows. Audio: environmental SFX only. No music. SUBJECT — @hero, woman in dark blazer, matches input 100%. Goal: enters a quiet office at night, alone, focused. WB 3200K. LOCATION — @office, style reference only, not a fixed keyframe. Dark wood desk, tall window, city lights outside. Subject moves freely through the space. ACTION — [0:00–4s] She opens the door, steps into the dark room, pauses, scanning the space. Hard cut. [4:00–9s] She crosses to the desk, reaches for the lamp, clicks it on — warm light spills across the desk. Hard cut. [9:00–15s] She sits, exhales, hands resting on the desk. Eyes lift toward the window. CAMERA — Shot 1: WS handheld, target: her silhouette in the doorway, follows her forward into the room. Shot 2: MS stabilized tracking, target: her hand on the lamp switch, ends on the light blooming across her face. Shot 3: slow dolly-in, target: her face, starts at MS, ends at CU — city lights reflected in her eyes. CONSTRAINTS — 16:9. No slow-motion. Stable face throughout, no morphing. Consistent outfit and lighting direction across all three shots.
Один и тот же принцип масштабируется на любую сцену — экшн, диалог, атмосферу, обзор продукта
Частые ошибки и что с ними делать

| Проблема | Что происходит | Решение |
|---|---|---|
| «Мыльная» картинка | Нет упоминания зерна, шейттера, физики света | Добавить Style Prefix из раздела 05 целиком |
| Камера «сама по себе» | Написано просто «camera moves» без цели | Формула: приём + объект фокуса + старт + направление + финал |
| Вялый монтаж | Склейки меняют только один параметр за раз | Правило двойного контраста — план и движение меняются вместе |
| Лицо «плывёт» | Промпт перегружен деталями мимики | 2–3 самых ясных признака вместо перечисления всех микровыражений |
| Обрыв на середине | Слишком много событий в таймлайне | Не больше 3–4 крупных событий на 15 секунд хронометража |
| Постоянное замедление | Slow-motion стоит по умолчанию на всей сцене | Включать замедление точечно, только на ключевых битах |
Попробуйте на своей сцене
Возьмите структуру из раздела 03 и соберите первый промпт по своей идее
Открыть Most-AI