Задай агенту границы безопасности. Верни ТОЛЬКО JSON: {"goal":"что разрешено сделать","allowed":"действия, которые агент выполняет сам","forbidden":"что запрещено категорически","confirm_before":"действия только после моего явного подтверждения"}
Веб-агент действует автономно — в этом его сила и его риск. Он может кликать, вводить данные, отправлять формы; значит, теоретически может и оплатить, и что-то отправить от твоего имени. Механика риска: агент оптимизирует выполнение цели и не чувствует последствий так, как человек — для него «нажать Оплатить» это просто следующий шаг к результату. Поэтому границы задаёшь ты, заранее. Базовое правило: разделяй действия на три корзины — можно сама, нельзя никогда, только с моим подтверждением. Приём: держи деньги и секреты вне досягаемости — не давай доступ к платёжным данным, паролям, кодам из СМС; пусть агент доводит до корзины и останавливается. Второй приём — «точка подтверждения»: любое необратимое действие (оплата, отправка заявки, удаление) агент делает только после явного «да». Инсайд: сформулируй запреты позитивно и конкретно — «останься на этапе корзины», а не туманное «будь осторожен». Типичная ошибка — дать доступ к оплате ради удобства. Экономия пары минут не стоит риска списания не туда.
Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.