LearnAI
Новинки AI · AI-агенты · Pelajaran 7/10
← Ke katalog
Tugas

Dimana letak kesalahan agennya?

Menilai risiko tugas dan memberikan perlindungan terhadap kesalahan agen. Kembalikan JSON {"task":"...","riskLevel":"...","riskyPoint":"...","safeguard":"..."}: task - tugas, riskLevel - salah satu dari: rendah, sedang, tinggi, riskyPoint - tempat paling berbahaya (di mana kemungkinan terjadi penemuan atau tindakan yang tidak dapat diubah), safeguard - bagaimana cara memeriksanya itu.

Buka kunci akses untuk mengirimkan solusi untuk peninjauan AI instan.
Tangkap kesalahan agen
💡 Sepotong teori

Agen memiliki kelemahan yang dapat diprediksi, dan mengetahuinya adalah setengah dari perjuangan. Pertama: nada percaya diri saat mengambil keputusan. Jika faktanya tidak cukup, agen akan tetap memberikan jawaban yang halus - hanya jawaban yang dibuat-buat. Kedua: looping - dia bisa berjalan berputar-putar, mengulangi satu langkah jika targetnya kabur. Ketiga: asumsi yang salah di awal sehingga menyebabkan seluruh pekerjaan berjalan ke arah yang salah. Mekanisme pertahanan didasarkan pada pemeriksaan. Trik orang dalam: mintalah tautan ke sumber untuk setiap pernyataan penting dan catatan langsung tentang ketidakpastian - “jika Anda tidak yakin, tulislah.” Lebih mudah untuk menangkap fiksi jika ada tautan di dekatnya. Teknik kedua adalah anggaran langkah-langkah dan langkah verifikasi terpisah: “lakukan, lalu periksa kembali hasilnya sesuai dengan kriteria ini.” Membatasi langkah mencegah Anda memasuki putaran tanpa akhir. Kesalahan umum adalah memercayai suatu jawaban karena tampilannya yang percaya diri dan detail yang meyakinkan. Persuasif dan kebenaran adalah dua hal yang berbeda. Nilai risiko tugas terlebih dahulu: semakin tinggi risikonya, semakin ketat verifikasinya dan semakin sedikit otonomi yang harus Anda berikan kepada agen.

Bagaimana penilaiannya · kelulusan 70

  • 1JSON valid tanpa teks di sekitarnya15%
  • 2Bidang yang wajib diisi ada di sana20%
  • 3riskLevel adalah salah satu nilai yang valid15%
  • 4Tempat berbahaya telah disebutkan, pertahanannya nyata50%
Perintah AndaClaude ⌄
🔒

Buka kunci akses untuk mengirimkan solusi untuk peninjauan AI instan.