Склади перший грамотний запит до "зрячого" AI під цю фотографію. Поверни JSON {"prompt":"...","goal":"...","context":"..."}: prompt — що саме ти питаєш у AI (саме питання, наприклад «що означає цей значок?»), ⟦3Зь — інше, ніж питання: наприклад, зрозуміле пояснення та висновок, чи можна безпечно їхати), context — що важливо знати AI, чого не видно на фото (марка/модель авто, коли зайнялося тощо).
"AI бачить" - не магія. Модель дробить картинку на тисячі дрібних ділянок і зіставляє їх із тим, що «запам'ятала» на мільйонах зображень: форми, текст, об'єкти, кольори. Підсумок - вона описує картинку словами всередині себе, а далі працює як із звичайним текстом. Звідси два висновки. Перший: чим зрозуміліший знімок (різкість, світло, об'єкт цілком у кадрі), тим точніше відповідь як людині при поганому освітленні. Другий: AI може впевнено помилитися в дрібній деталі, тому картинку треба не просто «кинути», а супроводжувати питанням та метою. Прийом профі: не питай розмито «що це?». Дай роль і ціль – «ти автомеханік, поясни новачкові, чи небезпечно їхати». Прихований прийом: спочатку попроси AI описати, ЩО він бачить на фото, і тільки потім робити висновки - так ти ловиш помилку розпізнавання до того, як повіриш пораді. Типова помилка новачка: прикріпити фото взагалі без тексту та чекати на читання думок. AI бачить пікселі, але не знає, НАВІЩО ти показав картинку.