Преврати расплывчатую идею «видео с кофе» в структурированный видео-промпт. Верни JSON: {"prompt":"один субъект и одно ясное действие","anchor":"описание якорного стартового кадра, который фиксирует композицию и цвет","motion":"какое движение в кадре (лёгкое, одно)","duration":"длительность в секундах, коротко"}
Понять механику видеоГенератор не рисует «ролик» целиком — он либо разворачивает кадры из шума по тексту, либо оживляет стартовую картинку, предсказывая движение пикселей между соседними кадрами. Отсюда главное отличие от статики: время и движение — это лишнее измерение, где легко накапливается «дрейф» (лицо плывёт, предмет деформируется). Рычаги контроля: короткий клип (3–6 сек), один субъект, одно ясное действие. Якорный кадр — стартовое изображение (режим «из картинки») — заранее фиксирует композицию, цвет и лицо, снижая непредсказуемость. Инсайд: сначала сделай сильный статичный кадр, а потом «оживляй» его — так ты контролируешь ~80% результата ещё до движения. Второй приём: движение задавай лёгкое и одно (пар поднимается ИЛИ рука наливает — не всё сразу). Типичная ошибка новичка: впихнуть в один ролик три действия и «эпичную камеру» — модель размажет всё в кашу и выдаст мерцающий брак.