Transforme o pedido vago “caneca linda” em um prompt estruturado. Retornar SOMENTE JSON: {"prompt":"...","style":"...","details":"..."} - em prompt reúna o assunto, ambiente e luz em uma frase, em style indique o estilo visual, em details adicione material, ângulo e formato.
O gerador de imagens não desenha como um ser humano. Ele é treinado em milhões de pares “imagem + legenda” e lembra a aparência dos objetos, estilos e luz. Ao fornecer o texto, o modelo começa com ruído aleatório e o remove passo a passo, aproximando a imagem do significado da descrição. Isto tem duas consequências. Primeiro: quanto mais específicas as palavras, menos a rede neural pensa por você - ela preenche uma solicitação vaga com o “usuário médio da Internet”. Segundo: o início é sempre a partir de ruído aleatório, então o mesmo prompt fornece imagens diferentes. Isso não é um bug, mas uma forma de obter opções. Alavancas de trabalho: substantivos âncora (o que exatamente está na moldura), adjetivos de material e luz, indicação de estilo e formato. Técnica interna: escreva o prompt em “camadas” – assunto, ambiente, luz, estilo; O modelo reage mais fortemente às primeiras palavras, então coloque o principal no início. Segundo truque: se gostar da imagem, fixe a semente e mude uma palavra de cada vez. Um erro típico de iniciante é carregar emoções (“lindo, uau”) em vez de atributos. A modelo não conhece o seu “lindo”; ela conhece “luz difusa suave”, “cerâmica”, “close-up”.