Faça a primeira solicitação competente à IA “avistada” usando esta foto. Return JSON {"prompt":"...","goal":"...","context":"..."}: prompt — o que exatamente você está PERGUNtando à IA (a pergunta em si, por exemplo, “o que este ícone significa?”), goal — qual RESULTADO você deseja obter como saída (isso é diferente de uma pergunta: por exemplo, uma explicação e conclusão claras, é possível dirigir com segurança), context - o que é importante saber IA, o que não está visível na foto (marca/modelo do carro, quando pegou fogo, etc.).
“IA vê” não é mágica. O modelo divide a imagem em milhares de pequenas seções e as compara com o que “lembra” de milhões de imagens: formas, texto, objetos, cores. O resultado é que ele descreve a imagem com palavras dentro de si e depois funciona como um texto comum. Há duas conclusões disso. Primeiro: quanto mais nítida a imagem (nitidez, luz, todo o objeto no quadro), mais precisa será a resposta - como uma pessoa com pouca iluminação. Segundo: a IA pode cometer erros com segurança em um pequeno detalhe, então a imagem não deve ser apenas “lançada”, mas acompanhada de uma pergunta e de um objetivo. Truque profissional: não pergunte vagamente “o que é isso?” Dê uma função e uma meta - “você é mecânico de automóveis, explique a um novato se dirigir é perigoso”. Truque oculto: primeiro peça à IA para descrever O QUE ela vê na foto e só então tire conclusões - assim você detecta o erro de reconhecimento antes de acreditar no conselho. Um erro típico de novato: anexar uma foto sem nenhum texto e esperar que a mente seja lida. A IA vê os pixels, mas não sabe POR QUE você mostrou a imagem.