Генерация из текста — режим, в котором нет ни камеры, ни исходного кадра: модель придумывает всё сама по описанию. Это самый гибкий и одновременно самый капризный режим. Ниже — что писать, какие настройки ставить и как выстроить итерации, чтобы не сжечь кредиты на случайных попытках.
Содержание
- Когда текст лучше изображения
- Из чего состоит рабочий промпт
- Настройки: что выбрать и почему
- Итерации: путь от первой попытки к результату
- Что модель делает плохо
- Частые вопросы
Когда текст лучше изображения
У генерации из текста есть ровно два преимущества, и оба существенные:
- Не нужен исходник. Сцены, которую невозможно снять или найти, просто не существует в виде фото — её можно только описать.
- Полная свобода композиции. Ракурс, план и движение камеры задаются словами, а не тем, что было в кадре.
Но у неё же есть и цена: больше попыток. Модель придумывает композицию, свет, внешность и движение одновременно, и ошибка в любом слое означает перегенерацию. Поэтому опытный процесс часто выглядит иначе: сначала получить статичный кадр, потом оживить его — это дешевле и предсказуемее, см. видео из фото.
Практическое правило: если подходящее изображение есть или его легко сделать — идите от изображения. Текстовый режим берите, когда исходника нет.
Из чего состоит рабочий промпт
Четыре блока в одном абзаце, в этом порядке:
1. Субъект. Кто или что в кадре. Физически и конкретно: возраст, одежда, состояние, материал. Плохо: «красивая девушка». Хорошо: «женщина около тридцати, в сером пальто, мокрые волосы».
2. Действие. Одно действие на ролик. Пятисекундный ролик не вмещает две сцены — модель ускорит обе и испортит обе. Плохо: «встаёт, идёт к окну, открывает его». Хорошо: «медленно поворачивает голову к окну».
3. Камера. Кадрирование и движение. Эти термины лучше писать латиницей — они точнее попадают: medium shot, slow dolly push-in, static locked-off shot. Словарь с переводами — в статье Seedance AI на русском.
4. Свет и стиль. Время суток, характер освещения, стилистика: golden hour, soft diffused light, backlight, cinematic, film grain.
Собранный пример:
Женщина около тридцати в сером пальто стоит на пустой платформе, мокрые волосы, вечер. Она медленно поворачивает голову в сторону тоннеля.
medium shot,very slow dolly push-in,shallow depth of field. Холодный люминесцентный свет,film grain,cinematic.
Готовые промпты по категориям, которые можно копировать: 24 примера промптов.
Настройки: что выбрать и почему
| Настройка | Для черновика | Для финала |
|---|---|---|
| Модель | Seedance 2.0 Mini | Seedance 2.0 или 2.5 |
| Разрешение | 480p | 720p или 1080p |
| Длительность | 4 секунды | 5–10 секунд |
| Соотношение сторон | целевое сразу | целевое |
| Звук | можно выключить | включён |
Три замечания по настройкам:
- Соотношение сторон ставьте целевым с самого начала. Композиция кадра в 16:9 и 9:16 — разная, и промпт, удачный в горизонтали, в вертикали может не сработать. Для Reels, Shorts и TikTok это 9:16.
- Длительность увеличивает не только цену, но и риск. Чем дольше ролик, тем больше шансов, что модель уплывёт от задуманного. Начинайте с 4–5 секунд.
- Разрешение — самый дорогой параметр. Разница между 480p и 1080p кратная, а композиция видна и в 480p. Черновики всегда в низком разрешении: как считаются кредиты.
Итерации: путь от первой попытки к результату
Первый результат почти никогда не совпадает с задуманным — это нормальный рабочий процесс, а не признак плохой модели. Важно менять по одному блоку за раз, иначе непонятно, что сработало.
Порядок, который сходится быстрее всего:
- Прогон 1 — сцена. Минимальный промпт: субъект + действие. Проверяете, правильно ли модель поняла содержание.
- Прогон 2 — камера. Добавляете кадрирование и движение. Здесь обычно происходит главный скачок качества.
- Прогон 3 — свет и стиль. Добавляете освещение и стилистику. Кадр начинает выглядеть намеренным.
- Прогон 4 — финал. Тот же промпт на старшей модели в нужном разрешении и длительности.
Четыре прогона, из которых три — дешёвые. Это существенно меньше, чем при попытке угадать всё сразу.
Если после трёх итераций сцена всё равно не собирается — обычно проблема не в промпте, а в задаче: слишком много объектов, слишком сложное действие или нужен текст в кадре. В этом случае проще разбить сцену на два ролика и склеить в монтаже.
Что модель делает плохо
Список, который экономит время, если знать заранее:
- Текст в кадре. Вывески, упаковка, титры — расплываются, кириллица особенно. Генерируйте кадр без текста, надписи накладывайте в монтаже.
- Кисти рук в движении. Пальцы искажаются. Если руки не нужны крупно — не выводите их на первый план.
- Толпа с лицами. Много мелких лиц = много артефактов. Общий план с силуэтами работает лучше.
- Точная физика взаимодействий. Жидкости, дым и ткань выглядят убедительно; сложные контакты объектов — хуже.
- Узнаваемые реальные люди и бренды. Такие запросы отклоняются на стороне модели.
- Осмысленная речь с синхронизацией губ. Атмосферный звук — да, диалог — нет. Закадровый голос надёжнее записать отдельно.
Частые вопросы
Сколько секунд максимум? 15 секунд у версий 2.0 и до 30 секунд у Seedance 2.5.
Можно ли сделать несколько связанных кадров? Да, на 2.5: кадры перечисляются подряд в одном промпте, обязательно с указанием сохранять персонажа и одежду. Пример такого промпта — в подборке промптов.
Промпт на русском работает хуже? Сюжет — так же хорошо. Технические операторские термины на английском попадают точнее: подробнее.
Будет ли звук? Да, звуковая дорожка генерируется вместе с видео и включена по умолчанию.
Можно ли попробовать бесплатно? Да, на бесплатных кредитах и модели Seedance 2.0 Mini до 720p: что доступно бесплатно.
Что делать, если результат почти хороший, но низкого разрешения? Есть два пути: перегенерировать в высоком разрешении тем же промптом или увеличить готовый ролик через апскейл видео.
Коротко: описывайте физически, одно действие на ролик, камеру термином, а итерации гоняйте в 480p на дешёвой модели. Открыть генерацию из текста.



