LearnAI
Новинки AI · Веб-агенты · レッスン 7/10
← カタログへ
タスク

セキュリティ: エージェントが停止する場所

エージェントにセキュリティ境界を与えます。 JSON のみを返します: {"goal":"許可され​​ている内容","allowed":"エージェント自身が実行するアクション","forbidden":"厳しく禁止されていること","confirm_before":"私の明示的な確認後にのみ行われるアクション"}

アクセスのロックを解除して、AI による即時レビューのためにソリューションを送信します。
安全境界線を設定する
💡 理論の一部

Web エージェントは自律的に動作します。これが Web エージェントの強みであり、リスクでもあります。彼はクリックしたり、データを入力したり、フォームを送信したりできます。これは、理論的には、ユーザーに代わって支払いや送信ができることを意味します。リスクの仕組み: エージェントは目標の達成を最適化し、人間のように結果を感じません。彼にとって、「支払いをクリックする」は、結果に向けた次のステップにすぎません。したがって、事前に境界を設定します。基本ルール: 行動を 3 つのバスケットに分割します。自分で行うこともできますが、決して行うことはできません。私の確認が必要です。秘訣: お金や秘密は手の届かないところに保管してください。SMS からの支払いデータ、パスワード、コードへのアクセスを許可しないでください。エージェントにバスケットまで運転してもらい、停止させます。 2 番目の手法は「確認ポイント」です。エージェントは、明示的な「はい」の後にのみ、取り消しできないアクション (支払い、申請の送信、削除) を実行します。インサイダー: 禁止事項を積極的かつ具体的に定式化します。漠然とした「注意してください」ではなく、「バスケットの段階に留まるよう」です。よくある間違いは、便宜のために支払いへのアクセスを許可することです。数分を節約しても、間違った場所で無駄にしてしまう危険を冒す価値はありません。

どのように評価されますか? 合格 70

  • 1周囲にテキストのない有効な JSON30%
  • 2goal、allowed、forbidden、confirm_before のフィールドがあります30%
  • 3秘密と支払いは禁止、確認事項あり40%
あなたのプロンプトClaude ⌄
🔒

アクセスのロックを解除して、AI による即時レビューのためにソリューションを送信します。