Как же я обожаю generative ai еще с самой первой версией Midjourney!
Ловите лучшие промт практики:
1. В описании сцены учитывать нужно все от места до звуков.
- Чтобы модель поняла, как распределить свет и движение камеры нужно добавить субъект, действие, место, время, стиль.
Так будет плохо:
“Человек идёт по улице.”
Так будет хорошо:
“A middle-aged man in a gray trench coat walks slowly down a rainy Tokyo street at night, neon lights reflecting on wet asphalt, camera follows from behind, shallow depth of field, cinematic tone.”
- Sora 2 лучше работает, когда понимает, из чего сделан мир.
Пример:
“A cozy morning scene inside an old Paris café, golden sunlight filters through dusty windows, steam rises from a cup of coffee, camera slowly pans across the table, 24 fps, cinematic lighting.”
- Описание звуков (даже если звуков нет) помогает синхронизировать движения и эмоцию.
Пример:
“Soft wind rustling leaves, distant thunder, footsteps on gravel.”
“A girl standing on a rooftop at night, city lights below, light breeze moves her hair, faint ambient music, camera circles around her slowly.”
- Стиль и цвет тоже лучше описывать максимально четко
Пример:
“Cinematic look, desaturated tones, high contrast, shallow depth of field, soft vignette.”
“1990s VHS style, grainy texture, washed-out colors, handheld camera.”
“Cyberpunk mood, strong neon blue and pink lighting, reflections on wet ground.”
- Модель нормально воспринимает 1–2 действия до 10 секунд, дальше начинает ломаться.
Будет плохо:
“Парень бежит, падает, поднимается, стреляет и смеётся.”
Будет хорошо:
“A soldier runs through a muddy trench during heavy rain, slips but keeps running, water splashing on the lens, 8 seconds, gritty war aesthetic.”
2. Крутыми видосы получаются за счет итераций:
- Базовый промпт.
- Дебаг по параметрам (свет, движение, лица).
- Точечные правки:
“keep face consistent”, “do not change clothes color”, “camera fixed angle”.
- Классно юзать Remix, Re-cut, Blend и удалять 2–3 секунды с глюками и перерировать только их вместо перегенерации.
- Еще можно объединять удачные кадры из разных версий
- А для этого обязательно фиксировать версии: night_city_v1, night_city_v2.
3. Нужно следить за промптом, потому что модель не умеет думать.
Поэтому думать приходится самим и проверять то что скармливаем модели на логику и противоречия.
Так модель сломается:
“Fast smooth slow camera pan.”
“Dark sunny morning.”
Вот так нет:
“Camera moves slowly through a dimly lit corridor, soft golden sunlight leaks from one window.”
4. Надо учитывать ограничения:
– физика воды и ткани всё ещё слабая
– длинные сцены теряют консистентность
– цвета и одежда могут меняться по ходу видоса
5. Ну и ловите под конец формулу идеального промпта:
Кто + Что делает + Где + Свет/атмосфера + Камера + Стиль + Длина
Пример:
“A teenage girl stands in front of a burning house at night, ash falling like snow, cinematic lighting, slow zoom in, 10 seconds, emotional tone of loss.”
Кстати, ищу человека, кто мне музыкальные тизеры будет в Sora2 и Veo3 клепать, напишите в личку @KumiKingKong. Наши ресурсы на это отвлекать не будем, а у самого нет времени, к сожалению.
Нужно что-то в стильке Voidstomper.
И кидайте свои самые крутые или самые упоротые видосы из Sora 2 в комменты! Давайте выберем лучшего Sora-креатора среди нас!