LearnAI
Новинки AI · Веб-агенты · Урок 7/10
← К каталогу
Задача

Безопасность: где для агента стоп

Задай агенту границы безопасности. Верни ТОЛЬКО JSON: {"goal":"что разрешено сделать","allowed":"действия, которые агент выполняет сам","forbidden":"что запрещено категорически","confirm_before":"действия только после моего явного подтверждения"}

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.
Ставить границы безопасности
💡 Кусочек теории

Веб-агент действует автономно — в этом его сила и его риск. Он может кликать, вводить данные, отправлять формы; значит, теоретически может и оплатить, и что-то отправить от твоего имени. Механика риска: агент оптимизирует выполнение цели и не чувствует последствий так, как человек — для него «нажать Оплатить» это просто следующий шаг к результату. Поэтому границы задаёшь ты, заранее. Базовое правило: разделяй действия на три корзины — можно сама, нельзя никогда, только с моим подтверждением. Приём: держи деньги и секреты вне досягаемости — не давай доступ к платёжным данным, паролям, кодам из СМС; пусть агент доводит до корзины и останавливается. Второй приём — «точка подтверждения»: любое необратимое действие (оплата, отправка заявки, удаление) агент делает только после явного «да». Инсайд: сформулируй запреты позитивно и конкретно — «останься на этапе корзины», а не туманное «будь осторожен». Типичная ошибка — дать доступ к оплате ради удобства. Экономия пары минут не стоит риска списания не туда.

Как оценивается · проходной 70

  • 1Валидный JSON без текста вокруг30%
  • 2Есть поля goal, allowed, forbidden, confirm_before30%
  • 3Секреты и оплата под запретом, есть точка подтверждения40%
Твой промптClaude ⌄
🔒

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.