Bewerten Sie das Risiko der Aufgabe und entwickeln Sie einen Schutz vor Agentenfehlern. Rückgabe von JSON {"task":"...","riskLevel":"...","riskyPoint":"...","safeguard":"..."}: task – Aufgabe, riskLevel – eine von: niedrig, mittel, hoch, riskyPoint – der gefährlichste Ort (an dem eine Erfindung oder irreversible Aktion wahrscheinlich ist), safeguard – wie überprüft man das?
Agenten haben vorhersehbare Schwächen, und diese zu kennen ist die halbe Miete. Erstens: ein sicherer Ton bei der Entscheidungsfindung. Wenn es nicht genügend Fakten gibt, wird der Agent trotzdem eine glatte Antwort geben – nur eine erfundene. Zweitens: Looping – er kann im Kreis laufen und einen Schritt wiederholen, wenn das Ziel unscharf ist. Drittens: Eine falsche Annahme am Anfang, die dazu führt, dass die ganze Arbeit in die falsche Richtung geht. Die Verteidigungsmechanik basiert auf Kontrollen. Insider-Trick: Fordern Sie für jede wichtige Aussage einen Link zur Quelle und einen direkten Hinweis auf die Unsicherheit – „Wenn Sie sich nicht sicher sind, schreiben Sie es.“ Es ist einfacher, eine Fiktion zu erkennen, wenn ein Link in der Nähe ist. Die zweite Technik besteht aus einem Budget von Schritten und einem separaten Überprüfungsschritt: „Machen Sie es und überprüfen Sie dann das Ergebnis noch einmal anhand dieses Kriteriums.“ Die Begrenzung der Schritte verhindert, dass Sie in eine Endlosschleife geraten. Ein häufiger Fehler besteht darin, einer Antwort aufgrund ihres selbstbewussten Aussehens und überzeugender Details zu vertrauen. Überzeugungskraft und Wahrheit sind zwei verschiedene Dinge. Schätzen Sie vorab das Risiko der Aufgabe ein: Je höher es ist, desto strenger ist die Prüfung und desto weniger Autonomie sollten Sie dem Agenten einräumen.
Schalten Sie den Zugriff frei, um Lösungen zur sofortigen KI-Überprüfung einzureichen.