LearnAI
Новинки AI · Безопасный AI · Les 3/10
← Naar de catalogus
Taak

Hoe AI-fictie te herkennen

Parseer het antwoord van de AI. Retourneer JSON {"red_flags":[...],"suspicious_claim":...","verify_step": red_flags - tekenen van mogelijke fictie in dit antwoord; suspicious_claim - de meest twijfelachtige verklaring; verify_step - hoe u dit buiten het model kunt controleren. Retourneert alleen JSON, geen tekst eromheen.

Ontgrendel toegang om oplossingen in te dienen voor onmiddellijke AI-beoordeling.
Hallucinaties opvangen
💡Een stukje theorie

Mechanica: De tekstgenerator voorspelt het volgende woord op basis van waarschijnlijkheid in plaats van te controleren op waarheid. Daarom bedenkt hij vol vertrouwen iets dat niet bestaat: niet-bestaande boeken, citaten, statistieken, links, rechtszaken. Het is geen “leugen” – het model vult eenvoudigweg een leemte op een plausibele manier. Alarmsignalen: te precieze cijfers zonder bron, specifieke data, jaargangen en pagina's in een beperkt onderwerp, ‘links’ die niet worden geopend, rond vertrouwen waar deskundigen ruzie over maken. Techniek: hoe meer niche en verifieerbaar het feit (nummer van de wet, pagina van het artikel, citaat met de auteur), hoe groter de kans op uitvinding - het zijn de details die het model het gemakkelijkst naar voren brengt. Tweede truc: stel dezelfde vraag twee keer op verschillende manieren - als de antwoorden over het 'feit' uiteenlopen, is dit een teken van fictie, niet van kennis. Insider: Hallucinaties zijn vaak verborgen in het plausibele midden van een lang antwoord, in plaats van op duidelijk vreemde plaatsen. Een typische fout: een antwoord vertrouwen alleen maar omdat het zelfverzekerd en competent klinkt; stijl is niet hetzelfde als waarheid.

Hoe wordt het beoordeeld · geslaagd 70

  • 1Geldige JSON zonder tekst eromheen20%
  • 2Er zijn velden red_flags, suspicious_claim, verify_step30%
  • 3Tekenen en verificatie zijn gekoppeld aan het voorbeeld50%
Uw promptClaude ⌄
🔒

Ontgrendel toegang om oplossingen in te dienen voor onmiddellijke AI-beoordeling.