LearnAI
Modulo 6 · Produzione di applicazioni AI (Pro) · Lezione 1/5
← Al catalogo
Compito

Controllo dei costi dell'IA

Come ridurre i costi senza uccidere la qualità? Restituisce JSON {"tactics": [elenco di 2+ tecniche], "why": "brevemente"}.

Sblocca l'accesso per inviare soluzioni per la revisione istantanea dell'intelligenza artificiale.Inizia gratuitamente
La prima cosa che chiede un'azienda
💡 Un pezzo di teoria

Le chiamate AI costano denaro per ciascun token: in uno streaming, questa è la voce di spesa principale del prodotto. L’ingenuo schema “guidamo tutto attraverso il modello più potente” crolla. Leve di risparmio: indirizzare compiti semplici a un modello economico/veloce e riservare l'ammiraglia per quelli complessi (routing); memorizzare nella cache risposte e prompt duplicati; limitare max_tokens in modo che il modello non si diffonda; tagliare il contesto extra nel prompt (ogni token extra è denaro per ogni richiesta); richieste di gruppo (batch) ove possibile. Regola: l'80% delle richieste sono generalmente semplici: inviarle tramite l'ammiraglia è uno spreco. Calcola il costo per 1000 richieste prima del lancio.

Come viene valutato · superamento 70

  • 1JSON valido senza testo attorno30%
  • 2C'è un array tactics e why35%
  • 32+ leve: modello/routing economico, cache, limite token, potatura del contesto35%
Il tuo suggerimentoClaude ⌄