LearnAI
Модуль 15 · Мультимодальний AI (Pro) · Урок 1/5
← До каталогу
Завдання

AI вміє бачити

Чи підходить мультимодальний AI і що він зробить? Поверни JSON {"suitable": "так чи ні", "how": "як застосувати"}.

Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.Почати безкоштовно
Мультимодальність
💡 Шматок теорії

Сучасні моделі не обмежені текстом — вони є мультимодальними: розуміють зображення, а деякі й аудіо, відео. Ти можеш показати моделі фото чека, скріншот помилки, графік, схему - і вона опише, витягне дані, пояснить. Під капотом картинка теж перетворюється на токени (візуальні) і потрапляє у той самий контекст, що й текст. Це відкриває завдання, недоступні текстовому AI: розібрати рукописну замітку, витягнути таблицю зі скріншота, зрозуміти, що не так на фото. Мультімодальність - це AI, який бачить світ, а не тільки читає про нього.

Як оцінюється · прохідний 70

  • 1Валідний JSON без тексту навколо30%
  • 2Є поля suitable та how35%
  • 3Так - показати фото, витягти поля в структуру35%
Твій промптClaude ⌄