LearnAI
Новинки AI · Безопасный AI · Pelajaran 4/10
← Ke katalog
Tugas

Membuat AI berkata "Saya tidak tahu"

Buat permintaan terhadap pemalsuan. Kembalikan JSON {"prompt":"...","rules":[...],"why_works":"..."}: prompt — teks permintaan ke AI; rules — aturan perilaku jika terjadi ketidaktahuan, yang disertakan dalam permintaan; why_works - secara singkat mengapa ini mengurangi fudge. Kembalikan hanya JSON, tidak ada teks di sekitarnya.

Buka kunci akses untuk mengirimkan solusi untuk peninjauan AI instan.
Prompt versus fiksi
💡 Sepotong teori

Mekanisme: secara default, model “berusaha membantu” dan melanjutkan teks, meskipun tidak ada data - diam bukanlah pilihan yang tepat. Artinya izin untuk tidak mengetahui harus diberikan secara tegas. Teknik cepat: (1) instruksi langsung – “jika Anda tidak yakin, katakan dengan jujur ​​‘Saya tidak tahu’ dan jangan mengada-ada”; (2) persyaratan sumber - “berikan hanya fakta yang dapat Anda sebutkan dengan sumbernya, tandai sisanya sebagai asumsi”; (3) pemisahan—“memisahkan fakta yang terverifikasi dari dugaan.” Orang dalam: minta model untuk memperkirakan tingkat kepercayaannya dalam persentase dan jelaskan APA sebenarnya yang tidak diketahuinya - hal ini secara tajam mengurangi pemalsuan yang meyakinkan, karena tugasnya berubah dari “memberikan jawaban” menjadi “menilai keandalan”. Trik kedua: merumuskan pertanyaan tanpa asumsi bawaan - “apakah hukum X ada?” alih-alih “menceritakan kembali Hukum X”, jika tidak, model akan mengkonfirmasi sesuatu yang tidak ada. Kesalahan umum yang sering terjadi: meyakini bahwa kalimat “jangan salah” yang sopan bisa berhasil—kita memerlukan aturan khusus untuk berperilaku dalam menghadapi ketidaktahuan, bukan permintaan tepatnya.

Bagaimana penilaiannya · kelulusan 70

  • 1JSON valid tanpa teks di sekitarnya20%
  • 2Ada bidang prompt, rules, why_works30%
  • 3Penyelidikan benar-benar menyelesaikan ketidaktahuan50%
Perintah AndaClaude ⌄
🔒

Buka kunci akses untuk mengirimkan solusi untuk peninjauan AI instan.