Trasforma la tua vaga idea di "video sul caffè" in un messaggio video strutturato. Return JSON: {"prompt":"un soggetto e un'azione chiara","anchor":"descrizione del fotogramma iniziale di ancoraggio che fissa la composizione e il colore","motion":"che tipo di movimento c'è nel fotogramma (luce, uno)","duration":"durata in secondi, brevemente"}
Il generatore non disegna l'intero "video": dispiega i fotogrammi dal rumore basato sul testo o anima l'immagine iniziale, prevedendo il movimento dei pixel tra i fotogrammi adiacenti. Da qui la principale differenza rispetto alla statica: il tempo e il movimento sono una dimensione in più dove si accumula facilmente la “deriva” (il volto fluttua, l'oggetto si deforma). Leve di controllo: clip breve (3-6 secondi), un soggetto, un'azione chiara. La cornice di ancoraggio - l'immagine iniziale (dalla modalità immagine) - fissa in anticipo la composizione, il colore e il volto, riducendo l'imprevedibilità. Insider: prima effettua uno scatto statico forte, quindi "animalo": in questo modo controlli circa l'80% del risultato anche prima del movimento. Seconda tecnica: rendere il movimento leggero e unico (il vapore sale OPPURE la mano versa - non tutto in una volta). Un tipico errore da principiante: mettere tre azioni e una "fotocamera epica" in un video: il modello spalmerà tutto in poltiglia e produrrà un difetto tremolante.