LearnAI
Новинки AI · Веб-агенты · Les 7/10
← Naar de catalogus
Taak

Beveiliging: waar de agent moet stoppen

Geef de agent beveiligingsgrenzen. ALLEEN JSON retourneren: {"goal 'wat mag worden gedaan', 'allowed' 'acties die de agent zelf uitvoert', 'forbidden 'wat is ten strengste verboden', 'confirm_before: acties alleen na mijn expliciete bevestiging'}

Ontgrendel toegang om oplossingen in te dienen voor onmiddellijke AI-beoordeling.
Stel veiligheidsgrenzen in
💡Een stukje theorie

De webagent handelt autonoom: dit is zijn kracht en zijn risico. Hij kan klikken, gegevens invoeren, formulieren indienen; Dit betekent dat het in theorie namens u iets kan betalen en verzenden. Risicomechanismen: de agent optimaliseert de vervulling van het doel en voelt de gevolgen niet als een persoon - voor hem is "click Pay" eenvoudigweg de volgende stap op weg naar het resultaat. Daarom stel je vooraf de grenzen vast. Basisregel: verdeel acties in drie manden - je kunt het zelf doen, je kunt het nooit doen, alleen met mijn bevestiging. Truc: houd geld en geheimen buiten bereik - geef geen toegang tot betaalgegevens, wachtwoorden, codes uit sms; laat de agent naar de mand rijden en stoppen. De tweede techniek is het “bevestigingspunt”: de agent voert elke onomkeerbare actie (betaling, aanvraag versturen, verwijderen) pas uit na een expliciet “ja”. Insider: formuleer de verboden positief en specifiek - “blijf in de mandfase”, en niet het vage “wees voorzichtig”. Een veelgemaakte fout is om voor het gemak toegang tot betaling te geven. Een paar minuten besparen is het risico niet waard om het op de verkeerde plaats op te schrijven.

Hoe wordt het beoordeeld · geslaagd 70

  • 1Geldige JSON zonder tekst eromheen30%
  • 2Er zijn velden goal, allowed, forbidden, confirm_before30%
  • 3Geheimen en betaling zijn verboden, er is een bevestigingspunt40%
Uw promptClaude ⌄
🔒

Ontgrendel toegang om oplossingen in te dienen voor onmiddellijke AI-beoordeling.