Как ускорить ответ? Верни JSON {"fixes": [список из 2+ приёмов], "why": "кратко"}.
Держит пользователяСкорость ответа определяет, будут ли пользоваться AI-фичей. Ожидание 8 секунд перед первым словом убивает опыт. Приёмы: стриминг — показывать ответ по мере генерации (первый токен уже через доли секунды, воспринимается быстрым); брать модель поменьше/побыстрее там, где хватает; сокращать промпт (длинный вход дольше обрабатывается); распараллеливать независимые вызовы вместо цепочки; кэшировать типовые ответы. Часто «медленно» — это не модель, а раздутый промпт и последовательные шаги, которые можно слить в параллель. Правило: показывай что-то немедленно (стриминг или заглушку), а не крутящийся индикатор.