LearnAI
Новинки AI · AI-агенты · Lezione 7/10
← Al catalogo
Compito

Dove sbaglia l'agente?

Valuta il rischio dell'attività e offri protezione contro gli errori dell'agente. Return JSON {"task":"...","riskLevel":"...","riskyPoint":"...","safeguard":"..."}: task - attività, riskLevel - uno tra: basso, medio, alto, riskyPoint - il luogo più pericoloso (dove è probabile un'invenzione o un'azione irreversibile), safeguard - come si fa controllalo.

Sblocca l'accesso per inviare soluzioni per la revisione istantanea dell'intelligenza artificiale.
Rileva gli errori dell'agente
💡 Un pezzo di teoria

Gli agenti hanno punti deboli prevedibili e conoscerli è metà dell'opera. Primo: un tono sicuro quando prendi una decisione. Se non ci sono abbastanza fatti, l'agente darà comunque una risposta semplice, solo inventata. Secondo: looping: può camminare in tondo, ripetendo un passo se il bersaglio è sfocato. Terzo: un presupposto sbagliato all’inizio, che fa sì che tutto il lavoro vada nella direzione sbagliata. La meccanica di difesa si basa sul controllo. Trucco da insider: richiedi un collegamento alla fonte per ogni affermazione importante e una nota diretta di incertezza: "se non sei sicuro, scrivilo". È più facile cogliere una finzione quando c'è un collegamento nelle vicinanze. La seconda tecnica prevede un bilancio di passaggi e una fase di verifica separata: “fallo, quindi ricontrolla il risultato secondo questo criterio”. Limitare i passaggi ti impedisce di entrare in un ciclo infinito. Un errore comune è fidarsi di una risposta a causa del suo aspetto sicuro e dei dettagli convincenti. Persuasività e verità sono due cose diverse. Valuta in anticipo il rischio dell’incarico: più è alto, più rigorosa sarà la verifica e minore sarà l’autonomia che dovrai dare all’agente.

Come viene valutato · superamento 70

  • 1JSON valido senza testo attorno15%
  • 2I campi obbligatori ci sono20%
  • 3riskLevel è uno dei valori validi15%
  • 4Il luogo pericoloso è stato nominato, la difesa è reale50%
Il tuo suggerimentoClaude ⌄
🔒

Sblocca l'accesso per inviare soluzioni per la revisione istantanea dell'intelligenza artificiale.