LearnAI
Modul 6 · Produksi Aplikasi AI (Pro) · Pelajaran 1/5
← Ke katalog
Tugas

Pengendalian biaya AI

Bagaimana cara mengurangi biaya tanpa mematikan kualitas? Kembalikan JSON {"tactics": [daftar 2+ teknik], "why": "singkat"}.

Buka kunci akses untuk mengirimkan solusi untuk peninjauan AI instan.Mulai secara gratis
Hal pertama yang ditanyakan sebuah bisnis
💡 Sepotong teori

Panggilan AI membutuhkan biaya untuk setiap token—di aliran, ini adalah item pengeluaran utama produk. Skema naif “kami mendorong segalanya melalui model yang paling kuat” hancur. Pengungkit penghematan: mengarahkan tugas-tugas sederhana ke model yang murah/cepat, dan menyimpan tugas unggulan untuk model yang rumit (perutean); men-cache tanggapan dan perintah duplikat; batasi max_tokens agar model tidak menyebar; potong konteks tambahan di prompt (setiap token tambahan adalah uang untuk setiap permintaan); permintaan grup (batch) jika memungkinkan. Aturan: 80% permintaan biasanya sederhana - mengirimkannya melalui aplikasi unggulan adalah pemborosan. Hitung biaya per 1000 permintaan sebelum peluncuran.

Bagaimana penilaiannya · kelulusan 70

  • 1JSON valid tanpa teks di sekitarnya30%
  • 2Ada larik tactics dan why35%
  • 32+ tuas: model/perutean murah, cache, batas token, pemangkasan konteks35%
Perintah AndaClaude ⌄