Як знизити витрати, не вбивши якість? Поверни JSON {"tactics": [список з 2+ прийомів], "why": "коротко"}.
AI-виклики коштують грошей за кожен токен - на потоці це головна стаття витрат продукту. Наївна схема «все женемо через найпотужнішу модель» руйнує. Важелі економії: спрямовувати прості завдання на дешеву/швидку модель, а флагман берегти для складних (роутинг); кешувати відповіді та промпти, що повторюються; обмежувати max_tokens, щоб модель не розтікалася; різати зайвий контекст у промпті (кожен зайвий токен – гроші на кожному запиті); групувати запити (batch), де можна. Правило: 80% запитів зазвичай прості – гнати їх через флагман марнотратно. Вважай вартість на 1000 запитів ще до запуску.