Bereiten Sie den Text für das Voiceover vor und beschreiben Sie die Präsentation. Return JSON {"script":"...","voice_style":"...","emphasis_notes":"..."}: kurzer Text „für das Ohr“ (bis zu 80 Wörter), Stimmstil (Ton, Tempo, Emotion) und Hinweise zu Pausen/Betonungen und komplexen Wörtern.
Die Sprachsynthese liest den Text mit Ihrer Stimme und er klingt genau so, wie Sie ihn geschrieben haben – das Modell liest ihn wörtlich. Das bedeutet, dass Sie „für das Ohr“ und nicht für das Auge schreiben müssen. Mechanik: Die Engine verwendet Text, Satzzeichen und Stilmarkierungen, um Intonation, Pausen und Tempo zu bilden. Hebel. Erstens steuert die Zeichensetzung den Rhythmus: Ein Punkt sorgt für eine Pause, ein Auslassungspunkt sorgt für Nachdenklichkeit, kurze Sätze klingen selbstbewusst, lange klingen schwerfällig. Zweitens legen Sie nicht nur den Text, sondern auch die Präsentation fest: Stimme (ruhiger Ansager, freundlich, energisch), Emotion und Tempo. „Lesen Sie dies“ und „Lesen Sie es warm und langsam, als ob es für einen Freund wäre“ führen zu unterschiedlichen Ergebnissen. Profi-Trick: Schreiben Sie komplexe Wörter, Namen und Abkürzungen so, wie sie klingen, oder teilen Sie sie auf – sonst liest die Engine sie auf ihre eigene Weise. Die zweite Technik: Platzieren Sie Pausen absichtlich (mit Kommas, Punkten, Zeilenumbrüchen), wo die Bedeutung einen Atemzug erfordert – die Natürlichkeit der Sprache basiert auf Pausen und nicht auf der Stimme. Ein typischer Fehler besteht darin, für die Synchronisation einen „mit den Augen zu lesenden Text“ mit langen Punkten und Fußnoten vorzulegen; es hört sich an, als würde es auseinanderfallen. Schreiben Sie kurz, sprechen Sie den Entwurf vorher laut aus.
Schalten Sie den Zugriff frei, um Lösungen zur sofortigen KI-Überprüfung einzureichen.