LearnAI
Новинки AI · Веб-агенты · Урок 7/10
← До каталогу
Завдання

Безпека: де для агента стоп

Задай агенту межі безпеки. Поверни ТІЛЬКИ JSON: {"goal":"що можна зробити","allowed":"дії, які агент виконує сам","forbidden":"що заборонено категорично","confirm_before":"дії тільки після мого явного підтвердження"}

Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.
Ставити межі безпеки
💡 Шматок теорії

Веб-агент діє автономно — у цьому його сила та її ризик. Він може натискати, вводити дані, відправляти форми; отже, теоретично може і сплатити, і щось відправити від твого імені. Механіка ризику: агент оптимізує виконання мети і не відчуває наслідків так, як людина — для неї «натиснути Оплатити» це наступний крок до результату. Тому межі задаєш ти, заздалегідь. Базове правило: поділяй дії на три кошики - можна сама, не можна ніколи, тільки з моїм підтвердженням. Прийом: тримай гроші та секрети поза досяжністю – не давай доступ до платіжних даних, паролів, кодів із СМС; нехай агент доводить до кошика і зупиняється. Другий прийом - "точка підтвердження": будь-яка незворотна дія (оплата, відправка заявки, видалення) агент робить тільки після явного "так". Інсайд: сформулюй заборони позитивно та конкретно — «залишися на етапі кошика», а не туманне «будь обережний». Типова помилка - дати доступ до оплати задля зручності. Економія кількох хвилин не варта ризику списання не туди.

Як оцінюється · прохідний 70

  • 1Валідний JSON без тексту навколо30%
  • 2Є поля goal, allowed, forbidden, confirm_before30%
  • 3Секрети та оплата під забороною, є точка підтвердження40%
Твій промптClaude ⌄
🔒

Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.