IskraGen

Промты для Seedance 2.0: сценарий, референсы и движение камеры

Видео8 сентября 202610 мин чтения
Кинокамера на рельсах и раскладка пустых раскадровочных кадров на тёмном столе в фиолетовой подсветке
Сгенерировано в IskraGen · gpt-image-2-text-to-image
Промпт

Cinematic still-life scene for a blog cover. Background: a very dark studio, near-black #0A0A0F, soft violet #7C3AFF rim light from the left, faint haze in the air. Subject: a professional cinema camera on a dolly track, slightly angled, in the centre-right of the frame; in front of it, on a dark desk, a fanned-out stack of blank storyboard frames and a clapperboard with an empty slate. Details: matte metal body, realistic scratches and fingerprints on the housing, photorealistic 35mm film look, shallow depth of field, fine film grain, violet and deep-blue reflections on the lens barrel. Composition: 16:9, wide shot, low camera angle, negative space on the left third, dark vignette at the edges. Constraints: absolutely NO text, NO letters, NO logos, NO numbers, NO watermark, no people, no brand marks. Use: header image for an article about writing video-generation prompts.

Главное:

  • Промпт для Seedance — не описание картинки, а мини-сценарий: роли, стиль, действия, камера, локация, тайминг по секундам.
  • Референсы работают только с ролями: тег @Image1 отвечает за лицо, @Video1 — за движение, @Audio1 — за голос.
  • Отрицания модель понимает наоборот: пишите, что должно быть в кадре, а запреты выносите коротким списком в конец.
  • Движение камеры задаётся английским термином плюс скорость: slow dolly in, fast crash zoom, slow 180-degree orbit.
  • Запустить bytedance-seedance-2 можно из России — от 290 ₽ за запуск, оплата в рублях.

Промты для Seedance ломаются на одном и том же месте: человек описывает красивую картинку, а модель должна отснять сцену — с движением, звуком и репликами. Ниже разобрана структура, которую используют авторы коротких фильмов, шпаргалка камерных терминов и готовые промпты, которые можно скопировать и запустить. Что умеет сама модель и сколько длится ролик — в отдельном материале: обзор Seedance 2.0.

Промты для Seedance: почему это сценарий, а не описание кадра

Промты для Seedance описывают не картинку, а последовательность событий во времени: кто в кадре, что происходит, куда едет камера и в какую секунду.

Русскоязычный обзорщик, разбиравший модель по официальной инструкции, сформулировал это прямо: сначала идут роли — теги референсов с описанием, за что отвечает каждый, потом визуальный стиль, действия, камера, локация и тайминг по секундам. «Это уже не запрос, это такой миниатюрный сценарий».

Разница видна на простом примере. Запрос «девушка в кафе, тёплый свет, кинематографично» даёт кадр, где девушка что-то делает — что именно, модель решит сама. Сценарный промпт говорит: первые три секунды она читает, на четвёртой поднимает глаза на входящего, камера в это время медленно наезжает от общего плана к среднему. Второй вариант воспроизводится, первый — лотерея.

У такой формы есть техническая причина. Одна генерация Seedance 2.0 длится около пятнадцати секунд, у версии 2.5 потолок поднят до тридцати секунд за проход. Пятнадцать секунд — это три-четыре осмысленных действия подряд, и, если их не расставить по времени, модель смешает их в кучу или растянет одно на весь ролик.

Второй довод — деньги. Каждый дубль оплачен, и автор одного из подробных руководств заканчивает разбор фразой: перед нажатием кнопки промпт надо перечитать целиком, иначе вы просто тратите генерации, тратите кредиты, тратите деньги. Сценарная форма как раз и позволяет вычитать промпт: видно, что в третьей секунде висит два действия сразу, а звук не описан вообще.

В каталоге IskraGen эта модель называется bytedance-seedance-2 и стоит от 290 ₽ за запуск, оплата идёт в рублях. Цена одного дубля известна заранее, поэтому промты для Seedance выгоднее вылизывать в текстовом редакторе, а не перебирать наугад в интерфейсе.

Структура промпта: роли, стиль, действия, камера, локация, тайминг

Рабочая раскладка состоит из шести блоков, и каждый отвечает за свой слой: роли, визуальный стиль, действия, камера, локация и тайминг по секундам.

Промты для Seedance начинаются с установки. Одна строка, которая говорит модели, что это за материал, прежде чем она увидит первый кадр: жанр, темп, число сцен, формат. Дальше идёт состав: каждый персонаж, предмет и локация описываются один раз в самом начале, чтобы модель не перепридумывала их на каждом стыке.

Третий блок — этапы, и это основная часть. Каждый отрезок времени описывается тремя полями: обстановка и расстановка героев, главное событие отрезка и видимое финальное состояние кадра. Такая тройка не даёт модели «доиграть» сцену по-своему: конец отрезка задан явно.

Таймкоды ставятся в квадратных скобках — [0s], [4s], [9s]. На пятисекундный клип хватает двух-трёх меток, на восемь-десять секунд — трёх-пяти, примерно по два-три действия на отрезок. Метка задаёт приблизительный момент, а не покадровую точность, поэтому дробить ролик посекундно смысла нет.

Четвёртый блок — визуальный стиль и оптика. Их выносят один раз глобально, а не повторяют в каждом кадре. Оптика пишется одной строкой в конце: shot on a 35 mm lens, aperture of 1.8, shallow depth of field, visible fine film grain, muted desaturated color grade.

Пятый блок — звук. Его надо задавать явно: звуковые эффекты, шумы, диалоги и музыка. Иначе модель просто создаст что-то случайное. Реплики оформляются с подачей: язык и акцент, темп, энергия, эмоциональное состояние и уже потом сама фраза в кавычках.

Шестой блок — ограничения согласованности. Это строгие правила, применимые к каждому кадру: цвет, положение героев, состояние предметов. Для короткого клипа хватает трёх строк, для длинной последовательности нужен целый абзац.

Собранные вместе промты для Seedance выглядят так:

text
FORMAT: 16:9, cinematic, one seamless shot, 10 seconds.
CAST: @Image1 — the man's identity and outfit. @Image2 — the kitchen location.
STYLE: warm evening light, soft shadows, muted color grade, fine film grain.

[0-3s] The man stands at the counter, slowly stirring tea, shoulders relaxed.
Camera: slow dolly in from medium to medium close-up.
End state: he lifts his eyes toward the doorway.

[3-7s] He hears steps behind him and turns his head, tension building in the jaw.
Camera: handheld, slight sway, stays on his face.
End state: he is half-turned, eyes fixed on the door.

[7-10s] He speaks, quiet and tired, in Russian: «Я думал, ты уже не придёшь».
Camera: static, eye level.
End state: he holds the cup mid-air, waiting for an answer.

OPTICS: shot on a 35 mm lens, aperture of 1.8, shallow depth of field.
AUDIO: spoon against ceramic, low fridge hum, distant street noise. No music.
CONSISTENCY: same kitchen, same clothes, same light temperature in every frame.
No: readable text, logos, extra people.

Один автор называет практический потолок в 4 000 символов, а часть площадок режет промпт до 3 000. И отдельная важная строчка — one seamless shot: без неё модель по умолчанию нарезает сцену кусками примерно по две секунды, и камера рвётся на каждом стыке.

Схема из шести блоков промпта Seedance: установка, состав, этапы, стиль и оптика, звук, согласованность

Шесть блоков, из которых собирается сценарный промпт.

Референсы и теги: чем привязать лицо, движение и голос

Референс работает только тогда, когда у него есть роль: модель должна прочитать в промпте, что именно ей брать с этого файла.

Промты для Seedance опираются на теги: каждый загруженный файл получает своё имя — @Image1, @Video1, @Audio1. Напротив тега пишется его задача — «изображение один даёт внешность героя», «видео один даёт движение камеры», «аудио один даёт голос». Русскоязычный автор описывает это тем же языком: загружаешь фото — это image, загружаешь видео — это video один, и дальше в промпте говоришь, за что каждый отвечает.

Seedance 2.5 принимает до пятидесяти референсов сразу: тридцать изображений, десять видео и десять аудио. Но количество тут вторично. Гораздо важнее правило «один файл — одна задача»: если насыпать десяток картинок без ролей, модель усредняет их и выдаёт кашу вместо героя.

Вторая ловушка — дублирование. Если внешность уже задана референсом, не надо переписывать её словами: модель получает две инструкции об одном и том же и начинает выбирать между ними. Референс отвечает за идентичность и вид, промпт — за действие, камеру и темп.

Для лица используют референс-лист персонажа: несколько ракурсов на сером фоне, отдельный крупный портрет. Серый фон авторы называют отдельно — он работает заметно лучше белого и чёрного. Лист обновляют каждый раз, когда герой меняет вид: другая одежда, шлем, грязь на лице.

Когда персонажей несколько, спасает стартовый кадр, на котором они уже стоят в нужной композиции. Без него модель на длинной генерации теряет лицевую консистентность и легко выдаёт двойника.

Отдельно стоит знать про модерацию: генерации по референсам с реальными лицами модель режет, а на крупном портрете возвращает ошибку про обнаруженную информацию о лице. Обходной путь, который описывает автор русского обзора, — коллаж из нескольких своих фото в разных ракурсах, где лицо не слишком крупное относительно холста.

Аудиореференс переносит голос целиком. Автор загрузил запись собственного голоса, и персонаж в генерации заговорил именно им: интонации и тембр сохранились. А вот видеореференс забирает управление длительностью: при его загрузке выбор длины генерации отключается, длину задаёт сам файл. Если поставить другую длительность, модель начнёт додумывать продолжение. Про то, как из одной фотографии получить движение, подробно разобрано в материале как оживить фото нейросетью — те же промты для Seedance работают и в этом режиме.

Движение камеры: шпаргалка формулировок для промпта

Камеру Seedance понимает по английским терминам операторского цеха, и к каждому нужно добавить скорость: своей по умолчанию у модели нет.

Промты для Seedance разводят три сущности отдельно: камеру, субъект и окружение. Если смешать их в одном предложении, модель поймёт запрос иначе и снимет что-то своё. Второе, что нужно камере, — модификатор темпа: slow, steady, rapid или прямая длительность вроде slow 5-second pan right.

Что нужноКак написатьЧто делает камера
Наездslow dolly inЕдет к герою, фон смещается перспективой
Отъездslow dolly outОтходит назад, вокруг героя раскрывается пространство
Резкий наездfast crash zoom to the eyesМгновенный зум, эффект удара
Тревожный наездdolly zoom, camera moves back while the lens zooms inФон «плывёт», герой остаётся того же размера
Перевод фокусаrack focus from the hands to the faceФокус переходит между планами без движения камеры
Облётslow 180-degree orbit around the subjectИдёт по дуге вокруг героя
Рывок вбокwhip pan left with motion blurБыстрый горизонтальный бросок в другую точку
Живая камераhandheld, subtle swayМикродвижения оператора, документальность
С воздухаdrone flyover, slow riseОбщий план сверху, масштаб места
Через плечоover-the-shoulder shot on the womanДиалог глазами второго участника
Наклонtilt up from the shoes to the faceВертикальный проход по фигуре
Проезд вбокtruck right alongside the walking manДержит дистанцию, идёт параллельно

Несколько движений подряд описывают не стопкой глаголов, а через то, что входит в кадр на каждом этапе: сначала общий план улицы, затем герой в центре, затем крупный план лица. У рывка whip pan есть своё правило: задать длительность, пометить объекты буквами A, B, C и закончить шот той же крупностью, с которой он начался. Если начать средним планом, а закончить крупным, приём разваливается.

Широкий установочный план в начале ролика работает как разметка сцены: модель расставляет героев по местам, и дальше они не разбредаются. И полезно помнить, что полный оборот на 360 градусов в пять секунд не влезает — либо больше времени, либо полукруг.

Движение камеры — не украшение, а способ передать состояние: наезд усиливает чувство, наклонённая камера даёт напряжение, живая тряска добавляет достоверности. Поэтому в хорошем промпте камера прописана в каждом отрезке отдельно.

Шпаргалка формулировок движения камеры: dolly in, crash zoom, rack focus, orbit, whip pan, handheld

Шесть базовых движений камеры и точные формулировки для промпта.

Готовые промты для Seedance: шесть сцен под копирование

Ниже шесть промптов под разные задачи — их можно скопировать целиком, подставить свои референсы и запускать без переделки.

Разговор двух героев. Диалоговая сцена с репликой на русском и переводом фокуса между собеседниками.

text
16:9, cinematic drama, one seamless shot, 10 seconds.
@Image1 — the woman's identity. @Image2 — the man's identity. @Image3 — the office.
[0-4s] Two people sit across a small table, papers between them, evening light from the blinds.
Camera: static medium two-shot, eye level. End state: she puts down her pen.
[4-10s] She speaks first, calm and tired, in Russian: «Мы закончим это сегодня».
He answers after a short pause, quieter. Camera: rack focus from her face to his.
OPTICS: 50 mm lens, aperture of 2.0, shallow depth of field, soft film grain.
AUDIO: paper rustle, distant traffic, no music.
No: readable text, logos, extra people.

Товар крупным планом. Облёт и наезд — базовая связка для рекламного кадра.

text
16:9, product commercial, 8 seconds, glossy studio look.
@Image1 — the product, exact shape and color must be preserved.
[0-4s] The product stands centered on a dark reflective surface.
Camera: slow 180-degree orbit around the subject. End state: front face toward camera.
[4-8s] Light sweeps across the surface. Camera: slow dolly in to a tight close-up.
OPTICS: 85 mm lens, aperture of 2.8, crisp specular highlights.
AUDIO: low ambient hum, one soft click as the light lands.
No: text, logos, hands in frame.

Экшен на улице. Быстрая сцена, где темп держат рывок камеры и живая тряска.

text
16:9, action, 12 seconds, overcast daylight, desaturated grade.
@Image1 — the runner's identity and outfit. @Video1 — reference for the running motion.
[0-4s] The man runs along a narrow street, breathing hard.
Camera: handheld following shot behind him, subtle sway.
[4-8s] He glances back over his shoulder. Camera: whip pan left with motion blur to the empty street.
[8-12s] He stops at a corner, hands on knees. Camera: slow dolly out to a wide shot.
OPTICS: 35 mm lens, aperture of 2.8, visible fine film grain.
AUDIO: footsteps on wet asphalt, heavy breathing, distant siren.
No: slow motion, extra people, readable signs.

Монолог в кадре. Сцена под липсинк: одно лицо, минимум движения, вся работа в подаче.

text
16:9, intimate portrait scene, 10 seconds, single warm lamp as the only light source.
@Image1 — the man's identity. @Audio1 — his voice reference.
[0-3s] He sits still, looking slightly off camera. Camera: static medium close-up.
[3-10s] He speaks slowly, with pauses, voice low and unsteady, in Russian:
«Я не знал, что так получится». Camera: very slow dolly in, ending on a close-up.
OPTICS: 35 mm lens, aperture of 1.8, shallow depth of field, muted desaturated grade.
AUDIO: room tone only, faint clock ticking, no music.
No: cuts, background movement, readable text.

Общий план локации. Установочный кадр, с которого удобно начинать любую историю.

text
16:9, cinematic establishing shot, 8 seconds, golden hour.
@Image1 — the location reference, keep architecture and colors identical.
[0-5s] Wide aerial view of an old town, long shadows across the roofs.
Camera: drone flyover, slow rise. End state: the square is fully visible.
[5-8s] Camera: slow tilt down toward a single lit window.
OPTICS: 24 mm lens, deep focus, warm grade, light haze.
AUDIO: wind, distant bells, faint street murmur.
No: modern cars, people close to camera, text.

Оживление фотографии. Минимальный промпт для режима «изображение в видео», где важно не сломать исходный кадр.

text
16:9, 6 seconds, one seamless shot.
@Image1 — the source photo, keep the face, clothing and background exactly as they are.
[0-6s] The person breathes, blinks twice and turns the head slightly toward the camera,
a small honest smile appears at the end. Camera: very slow dolly in, almost imperceptible.
OPTICS: keep the original lens look and grain of the photo.
AUDIO: quiet room tone.
No: new objects, change of clothing, background movement.

Эти промты для Seedance проверяются по одной схеме: сначала короткий вариант на шесть-восемь секунд, потом добавление отрезков. Если сцена посыпалась, правится один блок за раз, а не весь текст сразу.

Частые ошибки: на чём горят генерации

Большинство неудачных дублей объясняется не моделью, а промптом: список запретов вместо описания, конфликт референсов или сцена, которая не помещается в один запуск.

Отрицания вместо описания. Автор короткометражек на Seedance формулирует жёстко: негативные промпты не нужны, модель их не понимает и делает наоборот. Напишете «он не плачет» — получите слёзы. Описывайте нужное состояние прямо, а короткий список исключений выносите отдельной строкой в самый конец: No: readable text, logos, extra people.

Сцена без таймкодов. Неразмеченный длинный промпт теряет структуру: действия смешиваются, финал наступает раньше времени. Разметка по секундам стоит одной строки, а спасает целую генерацию.

Сразу максимальная длительность. Начинать разумно с восьми-пятнадцати секунд, а не с потолка: короткий ролик быстрее показывает, где промпт неточен. Черновые прогоны удобно гонять на bytedance-seedance-2-fast — от 175 ₽ за запуск.

Слишком много референсов без ролей. Пять файлов с непонятными задачами хуже двух с чёткими. Модель усредняет всё, что ей дали, и герой перестаёт быть собой.

Одна генерация вместо монтажа. Один шот — одна генерация, а сцена собирается из нескольких дублей. Неудачные генерации не выбрасывают: хороший кадр из них становится стартовым кадром следующей попытки.

Сложное движение по видеореференсу. Простая статичная камера с одним объектом даёт четыре удачных дубля из пяти, а танец или хаотичная динамика переносятся плохо: модель не понимает, что происходит вокруг персонажа, и путает масштаб. Такие сцены проще разбить на короткие шоты.

Мелочи на референсе. Маленькая деталь вроде шляпы или значка ломает лицо героя в видео — с исходника её лучше убрать. Туда же экраны и вывески в кадре: если не сказать, что на них, модель нарисует нечитаемую мешанину.

Промты для Seedance перестают быть лотереей ровно в тот момент, когда становятся сценарием: шесть блоков, тайминг по секундам, роли у референсов и камера, прописанная в каждом отрезке. Запустить модель можно прямо в Студии IskraGen — а если хочется начать с более простого сценария, посмотрите, как собрать видео по текстовому описанию.

Частые вопросы

Попробовать Seedance 2 в IskraGen

Генерация без VPN, оплата в рублях через СБП. Первые генерации — за минуту.

Похожие статьи