Donnez à l'agent des limites de sécurité. Renvoie UNIQUEMENT JSON : {"goal": "ce qui est autorisé à faire", "allowed": "actions que l'agent effectue lui-même", "forbidden": "ce qui est strictement interdit", "confirm_before": " actions uniquement après ma confirmation explicite"}
L'agent web agit de manière autonome, c'est sa force et son risque. Il peut cliquer, saisir des données, soumettre des formulaires ; Cela signifie que, théoriquement, il peut payer et envoyer quelque chose en votre nom. Mécanique du risque : l'agent optimise la réalisation de l'objectif et ne ressent pas les conséquences comme une personne - pour lui, « cliquer sur Payer » est simplement la prochaine étape vers le résultat. Par conséquent, vous fixez les limites à l’avance. Règle de base : divisez les actions en trois paniers - vous pouvez le faire vous-même, vous ne pourrez jamais le faire, seulement avec ma confirmation. Astuce : gardez l'argent et les secrets hors de portée - ne donnez pas accès aux données de paiement, aux mots de passe, aux codes SMS ; laissez l'agent se diriger vers le panier et s'arrêter. La deuxième technique est le « point de confirmation » : l'agent n'effectue toute action irréversible (paiement, envoi d'une candidature, suppression) qu'après un « oui » explicite. Insider : formulez les interdictions de manière positive et précise - « restez au stade du panier », et non le vague « soyez prudent ». Une erreur courante consiste à donner accès au paiement par souci de commodité. Gagner quelques minutes ne vaut pas le risque de les écrire au mauvais endroit.
Débloquez l’accès pour soumettre des solutions pour un examen instantané par l’IA.