Convierta la vaga solicitud "hermosa taza" en un mensaje estructurado. Devuelve SÓLO JSON: {"prompt":"...","style":"...","details":"..."} - en prompt recoge el tema, el ambiente y la luz en una frase, en style indica el estilo visual, en details agrega material, ángulo y formato.
El generador de imágenes no dibuja como un humano. Está entrenado en millones de pares de “imagen + título” y recuerda cómo son los objetos, los estilos y la luz. Cuando proporcionas texto, el modelo comienza con ruido aleatorio y lo elimina paso a paso, acercando la imagen al significado de la descripción. Esto tiene dos consecuencias. Primero: cuanto más específicas son las palabras, menos piensa la red neuronal por usted: completa una solicitud vaga con el "usuario promedio de Internet". Segundo: el inicio siempre es a partir de un ruido aleatorio, por lo que el mismo mensaje genera imágenes diferentes. Esto no es un error, sino una forma de obtener opciones. Palancas de trabajo: sustantivos de anclaje (qué hay exactamente en el marco), adjetivos de material y luz, indicación de estilo y formato. Técnica interna: escriba el mensaje en “capas”: tema, entorno, luz, estilo; El modelo reacciona con más fuerza a las primeras palabras, así que ponga lo principal al principio. Segundo truco: si te gusta la imagen, arregla su semilla y cambia una palabra a la vez. Un error típico de un principiante es cargar emociones (“hermoso, guau”) en lugar de atributos. La modelo no conoce tu “bella”; conoce “luz suave y difusa”, “cerámica”, “primer plano”.