LearnAI
Новинки AI · Веб-агенты · Lição 7/10
← Para o catálogo
Tarefa

Segurança: onde o agente deve parar

Dê limites de segurança ao agente. Retornar SOMENTE JSON: {"goal":"o que é permitido ser feito","allowed":"ações que o próprio agente executa","forbidden":"o que é estritamente proibido","confirm_before":"ações somente após minha confirmação explícita"}

Desbloqueie o acesso para enviar soluções para análise instantânea de IA.
Estabeleça limites de segurança
💡 Uma teoria

O agente web atua de forma autônoma - esta é a sua força e o seu risco. Ele pode clicar, inserir dados, enviar formulários; Isso significa que, teoricamente, ele poderá pagar e enviar algo em seu nome. Mecânica do risco: o agente otimiza o cumprimento da meta e não sente as consequências como uma pessoa – para ele, “clique em Pagar” é simplesmente o próximo passo rumo ao resultado. Portanto, você define os limites com antecedência. Regra básica: divida as ações em três cestas - você pode fazer isso sozinho, você nunca pode fazer isso, apenas com a minha confirmação. Truque: mantenha dinheiro e segredos fora do alcance - não dê acesso a dados de pagamento, senhas, códigos de SMS; deixe o agente dirigir até a cesta e parar. A segunda técnica é o “ponto de confirmação”: o agente realiza qualquer ação irreversível (pagamento, envio de solicitação, exclusão) somente após um “sim” explícito. Insider: formule as proibições de forma positiva e específica - “fique na fase de cesta”, e não o vago “tenha cuidado”. Um erro comum é conceder acesso ao pagamento por uma questão de comodidade. Economizar alguns minutos não vale o risco de descartá-lo no lugar errado.

Como é avaliado · aprovado 70

  • 1JSON válido sem texto ao redor30%
  • 2Existem campos goal, allowed, forbidden, confirm_before30%
  • 3Segredos e pagamentos são proibidos, existe um ponto de confirmação40%
Sua solicitaçãoClaude ⌄
🔒

Desbloqueie o acesso para enviar soluções para análise instantânea de IA.