LearnAI
Новинки AI · AI, который видит · Lección 1/10
← Al catálogo
Tarea

¿Qué significa "la IA ve"?

Haga la primera solicitud competente a la IA "vidente" utilizando esta foto. Devuelve JSON {"prompt":"...","goal":"...","context":"..."}: prompt: qué le estás PREGUNTANDO exactamente a la IA (la pregunta en sí, por ejemplo, “¿qué significa este ícono?”), goal: qué RESULTADO desea obtener como resultado (esto es diferente a una pregunta: por ejemplo, una explicación clara y una conclusión sobre si es posible conducir con seguridad), context - qué es importante saber sobre la IA, qué no se ve en la foto (marca/modelo del coche, cuándo se incendió, etc.).

Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.Empieza gratis
La base de la multimodalidad.
💡 Un pedazo de teoría

“La IA ve” no es magia. El modelo divide la imagen en miles de pequeñas secciones y las compara con lo que "recordaba" de millones de imágenes: formas, texto, objetos, colores. El resultado es que describe la imagen con palabras dentro de sí misma y luego funciona como con texto normal. Hay dos conclusiones de esto. Primero: cuanto más clara sea la imagen (nitidez, luz, todo el objeto en el encuadre), más precisa será la respuesta, como una persona con poca iluminación. Segundo: la IA puede cometer errores con confianza en un pequeño detalle, por lo que la imagen no debe simplemente "lanzarse", sino ir acompañada de una pregunta y un objetivo. Truco profesional: no preguntes vagamente "¿qué es esto?" Asigne un rol y un objetivo: "usted es mecánico de automóviles, explíquele a un novato si conducir es peligroso". Truco oculto: primero pídale a la IA que describa LO que ve en la foto, y solo luego saque conclusiones; de esta manera detectará el error de reconocimiento antes de creer en el consejo. Un error típico de un novato: adjuntar una foto sin ningún texto y esperar a que le lean la mente. La IA ve los píxeles, pero no sabe POR QUÉ mostraste la imagen.

¿Cómo se evalúa · aprobado? 70

  • 1JSON válido sin texto alrededor25%
  • 2Hay campos prompt, goal, context25%
  • 3La solicitud está vinculada a una foto y un propósito.50%
Tu mensajeClaude ⌄
🔒

Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.

Empieza gratis