Transformez la vague demande « belle tasse » en une invite structurée. Renvoyez JSON UNIQUEMENT : {"prompt": "...", "style": "...", "details": "..."} - en prompt, rassemblez le sujet, l'environnement et la lumière en une seule phrase, en style indiquez le style visuel, en details ajoutez le matériau, l'angle et le format.
Le générateur d'images ne dessine pas comme un humain. Il est formé sur des millions de paires « image + légende » et mémorise à quoi ressemblent les objets, les styles et la lumière. Lorsque vous fournissez du texte, le modèle commence par un bruit aléatoire et le supprime étape par étape, rapprochant ainsi l'image du sens de la description. Cela a deux conséquences. Premièrement : plus les mots sont précis, moins le réseau neuronal réfléchit à votre place - il répond à une vague demande auprès de « l'internaute moyen ». Deuxièmement : le démarrage se fait toujours à partir d'un bruit aléatoire, donc la même invite donne des images différentes. Ce n'est pas un bug, mais un moyen d'obtenir des options. Leviers de travail : noms d'ancrage (ce qu'il y a exactement dans le cadre), adjectifs de matière et de lumière, indication de style et de format. Technique d'initié : écrivez l'invite en « couches » : sujet, environnement, lumière, style ; Le modèle réagit plus fortement aux premiers mots, mettez donc l'essentiel au début. Deuxième astuce : si l'image vous plaît, corrigez sa graine et changez un mot à la fois. Une erreur typique du débutant est de charger des émotions (« magnifique, wow ») au lieu d'attributs. Le mannequin ne connaît pas votre « belle » ; elle connaît la « lumière douce et diffuse », la « céramique », le « gros plan ».