LearnAI
Новинки AI · Безопасный AI · Lección 3/10
← Al catálogo
Tarea

Cómo reconocer la ficción de IA

Analiza la respuesta de la IA. Devuelve JSON {"red_flags":[...],"suspicious_claim":"...","verify_step":"..."}: red_flags - signos de posible ficción en esta respuesta; suspicious_claim - la afirmación más dudosa; verify_step - cómo comprobarlo fuera del modelo. Devuelve solo JSON, sin texto alrededor.

Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.
Atrapar alucinaciones
💡 Un pedazo de teoría

Mecánica: el generador de texto predice la siguiente palabra basándose en la probabilidad en lugar de verificar la verdad. Por eso, inventa con confianza algo que no existe: libros, citas, estadísticas, enlaces, casos judiciales inexistentes. No es una "mentira": el modelo simplemente llena un vacío de manera plausible. Señales de alerta: números demasiado precisos sin fuente, fechas concretas, volúmenes y páginas sobre un tema limitado, “enlaces” que no se abren, confianza redonda donde los expertos discuten. Técnica: cuanto más específico y verificable sea el hecho (número de la ley, página del artículo, cita del autor), mayores serán las posibilidades de invención: son los detalles los que el modelo encuentra con mayor facilidad. Segundo truco: haga la misma pregunta dos veces de diferentes maneras; si las respuestas sobre el "hecho" divergen, esto es un signo de ficción, no de conocimiento. Información privilegiada: las alucinaciones a menudo se esconden en el medio plausible de una respuesta larga, en lugar de en lugares obviamente extraños. Un error típico: confiar en una respuesta sólo porque parece segura y competente; el estilo no es lo mismo que la verdad.

¿Cómo se evalúa · aprobado? 70

  • 1JSON válido sin texto alrededor20%
  • 2Hay campos red_flags, suspicious_claim, verify_step30%
  • 3Las señales y la verificación están vinculadas al ejemplo.50%
Tu mensajeClaude ⌄
🔒

Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.