Опишите настройку говорящего презентера под готовую озвучку. Верни JSON {"prompt":"...","framing":"...","expression":"...","negative":"..."}, где framing — план и композиция, expression — мимика и взгляд, negative — артефакты, которых избегаем.
Говорящий аватар-ведущийЛипсинк-модель синхронизирует форму рта под звуковую дорожку кадр за кадром. Работает точнее всего на фронтальном или почти фронтальном плане, при ровном мягком свете и крупности «голова и плечи» — тогда рту хватает пикселей, чтобы попасть в фонемы. Резкие повороты головы, профиль и жёсткие тени на лице — враги синхрона: рот начинает дрожать и мерцать. Композиция как у ведущего новостей: глаза на верхней трети кадра, немного воздуха над головой, взгляд точно в объектив — контакт со зрителем создаёт именно взгляд в камеру. Инсайд: живого презентера делают микродвижения — редкое моргание, лёгкие кивки, естественные паузы, смещение веса. Без них лицо застывает и попадает в «зловещую долину», поэтому проси их явно. Второй приём: дроби речь на сцены по 8-15 секунд — на длинной реплике артефакты накапливаются, а зритель устаёт от статики. Типичная ошибка: одна говорящая голова на 40 секунд без монтажа и жестов — выглядит мёртво и дёшево.