1 つの短いビデオについて説明します。 JSON を返す {"idea":"...","prompt":"...","duration":"..."}: idea - ワンフレーズでのアイデア、prompt - 「主題 + 1 つのアクション + 環境 + 気分」の式を使用したシーンの説明、duration - 秒単位の継続時間 (数字 + 「秒」)。
AI ビデオは非常に高速なアニメーターのように機能します。ニューラル ネットワークは何百万ものビデオを見て、ピクセルがフレームごとにどのように変化するかを予測することを学習しました。あなたがテキストを与えると、彼女は動きを完了します。理解することが重要です。これは既製のクリップを貼り合わせるのではなく、各フレームを新たに生成するので、説明が明確であればあるほど、画像はより安定します。最初のプロンプトの有効な公式: 主題 + 1 つのアクション + 環境 + 気分。 「美しい街」ではなく、「木の桟橋で網を繕う年老いた漁師、朝霧」。インサイダー: 3 ~ 5 秒の短いビデオは、ほとんどの場合、長いビデオよりもきれいに仕上がります。モデルは動きのロジックを維持しており、手や顔が「浮いて」いません。もう 1 つのトリック: ビデオごとに 1 つのアクションです。 2 つのチームが連続して (「歩いてから座る」) とモデルが混乱し、それらが混ざってドロドロになります。典型的な初心者の間違いは、天気、たくさんのアイテム、3 人のキャラクターなど、10 個の詳細を一度に入力してしまうことです。モデルがすべてを保持するわけではありません。 1 つの明確なシーンと 1 つのキャラクターから始めて、それを複雑にしていきます。