Розбери сцену частинами. Поверни JSON {"subject":"...","action":"...","setting":"...","shot":"...","style":"..."}: subject — хто/що setting, action shot - план і ракурс (великий/середній/загальний, рівень камери), style - візуальний стиль.
У відеопромпту є скелет, як у кіношного кадру. Розклади його на частини: суб'єкт (хто/що), дія (що робить), оточення (де і коли), план (великий, середній, загальний), ракурс (рівень очей, зверху, знизу), світло та настрій (теплий захід сонця, холодний ранок), стиль (реалізм, акварель, 3D). Нейросеть читає опис як режисерську заявку: що точніше названа кожна частина, то менше вона додумує за тебе. Ключовий прийом - ОДНА дія на сцену. «Дитина запускає паперовий літачок» утримається, а «біжить, стрибає, ловить, сміється» розвалиться на артефакти. Другий прийом: спочатку опиши щільний статичний кадр, як фотографію, і тільки потім додай рух - модель спочатку будує стійку композицію, а потім пожвавлює її. Типова помилка - писати емоції замість дій: "атмосферно", "епічно" модель розуміє погано. Заміни на видиме: «камера повільно наїжджає, порошинки у промені світла». Правило просте: якщо дію не можна показати на екрані, модель її проігнорує.
Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.