LearnAI
Модуль 14 · Голос и мультимодальные приложения (Pro) · Урок 4/5
Задача

Голосовой ассистент

Из чего состоит голосовой цикл? Верни JSON {"pipeline": [список из 2+ звеньев], "why": "кратко"}.

Полный голосовой цикл
💡 Кусочек теории

Голосовой ассистент — это цикл из нескольких звеньев: речь пользователя, затем STT (в текст), затем LLM (понимание и ответ), затем TTS (озвучка), и снова слушаем. Ключевое ограничение — ЗАДЕРЖКА: каждое звено добавляет секунды, а в живом разговоре пауза больше 1-2 секунд ощущается как тормоз. Поэтому используют потоковый STT, быстрые модели, стриминг ответа и начинают озвучку до готовности всего текста. Плюс нужна логика очередности (когда пользователь закончил говорить) и обработка перебиваний. Правило: голосовой ассистент — конвейер STT→LLM→TTS, где всё решает суммарная задержка; оптимизируй каждое звено и стримь, иначе диалог ощущается медленным.

Как оценивается · проходной 70

  • 1Валидный JSON без текста вокруг30%
  • 2Есть массив pipeline и why35%
  • 32+ звена: STT, LLM, TTS + оптимизация задержки/стриминг35%
Твой промптClaude ⌄
🔒

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.

Открыть полный доступ · $49