Підготуй аватара, що говорить. Поверни JSON {"avatar":"...","script":"...","emotion":"...","voice":"..."}: avatar - опис зовнішності та плану, script - репліка 1-1 ОДНА емоція на репліку, voice - характер голосу (тембр, темп).
Аватар, що говорить - це два движки в упряжці: один створює обличчя і міміку, другий синхронізує губи зі звуком (ліпсинк). Нейросеть розбиває мову на фонеми — дрібні звуки — і підбирає під них ротову форму. Звідси головне правило: пиши скрипт так, як кажуть, а не як пишуть. Короткі фрази, прості слова, без довгих причетних обертів — інакше губи «жують» і розсинхронно впадає у вічі. Механіка міміки: модель зчитує емоцію з опису та розділових знаків, тому явно вказуй настрій («дружелюбно, з легкою посмішкою») і став паузи крапками. Інсайд: Тримай одну емоцію на репліку. Різка зміна "радість - гнів - сум" за три секунди ламає обличчя в неприродну маску. Другий прийом — приблизно 2 слова за секунду: якщо наштовхати багато тексту в короткий кліп, липсинк з'їде. Вважай довжину озвучки заздалегідь. Типова помилка - писати роботизований текст з абревіатурами та цифрами («ROI виріс на 27,4%»): модель скаже це криво. Розшифровуй словами та перевіряй на слух.
Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.