LearnAI
Новинки AI · Видео и анимация · Урок 7/10
← К каталогу
Задача

Говорящий аватар и липсинк

Подготовь говорящего аватара. Верни JSON {"avatar":"...","script":"...","emotion":"...","voice":"..."}: avatar — описание внешности и плана, script — реплика 10-18 слов «как говорят», emotion — ОДНА эмоция на реплику, voice — характер голоса (тембр, темп).

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.
Диктор без съёмки
💡 Кусочек теории

Говорящий аватар — это два движка в упряжке: один создаёт лицо и мимику, второй синхронизирует губы со звуком (липсинк). Нейросеть разбивает речь на фонемы — мелкие звуки — и подбирает под них форму рта. Отсюда главное правило: пиши скрипт так, как ГОВОРЯТ, а не как пишут. Короткие фразы, простые слова, без длинных причастных оборотов — иначе губы «жуют» и рассинхрон бросается в глаза. Механика мимики: модель считывает эмоцию из описания и знаков препинания, поэтому явно указывай настроение («дружелюбно, с лёгкой улыбкой») и ставь паузы точками. Инсайд: держи одну эмоцию на реплику. Резкая смена «радость — гнев — грусть» за три секунды ломает лицо в неестественную маску. Второй приём — примерно 2 слова в секунду: если натолкать много текста в короткий клип, липсинк съедет. Считай длину озвучки заранее. Типичная ошибка — писать роботизированный текст с аббревиатурами и цифрами («ROI вырос на 27,4%»): модель произнесёт это криво. Расшифровывай словами и проверяй на слух.

Как оценивается · проходной 70

  • 1Валидный JSON без текста вокруг25%
  • 2Есть поля avatar, script, emotion, voice25%
  • 3Скрипт «как говорят» и по длине35%
  • 4Одна эмоция на реплику15%
Твой промптClaude ⌄
🔒

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.