エージェントにセキュリティ境界を与えます。 JSON のみを返します: {"goal":"許可されている内容","allowed":"エージェント自身が実行するアクション","forbidden":"厳しく禁止されていること","confirm_before":"私の明示的な確認後にのみ行われるアクション"}
Web エージェントは自律的に動作します。これが Web エージェントの強みであり、リスクでもあります。彼はクリックしたり、データを入力したり、フォームを送信したりできます。これは、理論的には、ユーザーに代わって支払いや送信ができることを意味します。リスクの仕組み: エージェントは目標の達成を最適化し、人間のように結果を感じません。彼にとって、「支払いをクリックする」は、結果に向けた次のステップにすぎません。したがって、事前に境界を設定します。基本ルール: 行動を 3 つのバスケットに分割します。自分で行うこともできますが、決して行うことはできません。私の確認が必要です。秘訣: お金や秘密は手の届かないところに保管してください。SMS からの支払いデータ、パスワード、コードへのアクセスを許可しないでください。エージェントにバスケットまで運転してもらい、停止させます。 2 番目の手法は「確認ポイント」です。エージェントは、明示的な「はい」の後にのみ、取り消しできないアクション (支払い、申請の送信、削除) を実行します。インサイダー: 禁止事項を積極的かつ具体的に定式化します。漠然とした「注意してください」ではなく、「バスケットの段階に留まるよう」です。よくある間違いは、便宜のために支払いへのアクセスを許可することです。数分を節約しても、間違った場所で無駄にしてしまう危険を冒す価値はありません。
アクセスのロックを解除して、AI による即時レビューのためにソリューションを送信します。