漠然とした「コーヒービデオ」のアイデアを構造化されたビデオプロンプトに変えます。 JSON を返す: {"prompt":"1 つの主題と 1 つの明確なアクション","anchor":"構図と色を固定するアンカー開始フレームの説明","motion":"フレーム内にどのような動きがあるか (軽い、1 つ)"、"duration":"持続時間 (秒、簡潔)"}
ジェネレーターは「ビデオ」全体を描画しません。テキストに基づいてノイズからフレームを展開するか、隣接するフレーム間のピクセルの動きを予測して開始画像をアニメーション化します。したがって、静的との主な違いは、時間と動きは「ドリフト」が蓄積しやすい追加の次元です (顔が浮き、オブジェクトが変形します)。コントロールレバー: 短いクリップ (3 ~ 6 秒)、1 つの主題、1 つの明確なアクション。アンカー フレーム - (写真モードからの) 開始画像 - 構図、色、顔を事前に修正し、予測不可能性を軽減します。インサイダー: 最初に強力な静止ショットを撮影し、次にそれを「アニメーション化」します。この方法では、動く前であっても結果の最大 80% を制御できます。 2番目のテクニック:動作を軽く、単一にします(蒸気が立ち上るか、手が注ぐ - 一度にではありません)。典型的な初心者の間違い: 3 つのアクションと「壮大なカメラ」を 1 つのビデオに詰め込みます。モデルはすべてをどろどろに汚し、ちらつく欠陥を生成します。