LearnAI
Moduł 6 · Produkcja aplikacji AI (Pro) · Lekcja 1/5
← Do katalogu
Zadanie

Kontrola kosztów AI

Jak obniżyć koszty, nie zabijając jakości? Zwróć JSON {"tactics": [lista 2+ technik], "why": "krótko"}.

Odblokuj dostęp, aby przesyłać rozwiązania do natychmiastowej oceny AI.Zacznij za darmo
Pierwsza rzecz, o którą pyta firma
💡 Kawałek teorii

Wywołania AI kosztują każdy token – w strumieniu jest to główna pozycja wydatków produktu. Naiwny schemat „przejeżdżamy wszystko przez najpotężniejszy model” legnie w gruzach. Dźwignie oszczędzania: kieruj proste zadania do taniego/szybkiego modelu i zapisz okręt flagowy dla skomplikowanych (trasowanie); buforuj zduplikowane odpowiedzi i podpowiedzi; ogranicz max_tokens, aby model się nie rozprzestrzeniał; wytnij dodatkowy kontekst w monicie (każdy dodatkowy token to pieniądze za każde żądanie); żądania grupowe (wsadowe), jeśli to możliwe. Zasada: 80% żądań jest zazwyczaj prostych – wysyłanie ich przez flagowiec jest marnotrawstwem. Oblicz koszt na 1000 żądań przed uruchomieniem.

Jak jest oceniane · zaliczenie 70

  • 1Prawidłowy JSON bez tekstu wokół niego30%
  • 2Istnieje tablica tactics i why35%
  • 3Ponad 2 dźwignie: tani model/trasowanie, pamięć podręczna, limit tokenów, czyszczenie kontekstu35%
Twoja zachętaClaude ⌄