LearnAI
Новинки AI · Видео и анимация · Lekcja 7/10
← Do katalogu
Zadanie

Mówiący awatar i synchronizacja warg

Przygotuj mówiącego awatara. Zwróć JSON {"avatar":"...","script":"...","emotion":"...","voice":"..."}: avatar - opis wyglądu i planu, script - replika 10-18 słów „jak to się mówi”, emotion - JEDNA emocja na replikę, voice — znak głosowy (barwa, tempo).

Odblokuj dostęp, aby przesyłać rozwiązania do natychmiastowej oceny AI.
Spiker bez filmowania
💡 Kawałek teorii

Mówiący awatar to dwa silniki w uprzęży: jeden tworzy twarz i mimikę, drugi synchronizuje usta z dźwiękiem (lip sync). Sieć neuronowa dzieli mowę na fonemy – małe dźwięki – i dobiera do nich kształt ust. Stąd główna zasada: pisz scenariusz JAK MÓWIĄ, a nie jak piszą. Krótkie frazy, proste słowa, bez długich fraz partycypacyjnych - w przeciwnym razie usta będą „żuć”, a brak synchronizacji będzie oczywisty. Mechanika mimiki: modelka odczytuje emocje z opisu i znaków interpunkcyjnych, dzięki czemu wyraźnie wskazuje nastrój („przyjazny, z lekkim uśmiechem”) i przerywane pauzy. Insider: zachowaj jedną emocję w każdym wierszu. Nagła zmiana „radości – złości – smutku” w ciągu trzech sekund zamienia twarz w nienaturalną maskę. Druga technika to około 2 słowa na sekundę: jeśli upchniesz dużo tekstu w krótkim klipie, synchronizacja ruchu warg zostanie zakłócona. Oblicz wcześniej długość lektora. Typowym błędem jest pisanie tekstu robotycznego ze skrótami i liczbami („ROI wzrósł o 27,4%”): model wymówi go krzywo. Rozszyfruj to słowami i przetestuj ze słuchu.

Jak jest oceniane · zaliczenie 70

  • 1Prawidłowy JSON bez tekstu wokół niego25%
  • 2Istnieją pola avatar, script, emotion, voice25%
  • 3Skrypt „jak to mówią” i pod względem długości35%
  • 4Jedna emocja w każdym wierszu15%
Twoja zachętaClaude ⌄
🔒

Odblokuj dostęp, aby przesyłać rozwiązania do natychmiastowej oceny AI.