LearnAI
모듈 15 · 멀티모달 AI(프로) · 수업 1/5
← 카탈로그로

AI가 볼 수 있다

멀티모달 AI가 적합하며 어떤 역할을 합니까? JSON {"suitable": "예 또는 아니요", "how": "신청 방법"}을 반환합니다.

즉각적인 AI 검토를 위해 솔루션을 제출할 수 있는 액세스 권한을 잠금 해제하세요.무료로 시작하세요
다중 양식
💡 이론의 일부

최신 모델은 텍스트에만 국한되지 않고 다중 모드입니다. 이미지를 이해하고 일부는 오디오 및 비디오도 이해합니다. 모델에게 영수증 사진, 오류 스크린샷, 그래프, 다이어그램을 보여줄 수 있습니다. 그러면 모델이 모델에 대해 설명하고 데이터를 추출하여 설명할 것입니다. 내부적으로는 그림도 토큰(시각적)으로 바뀌어 텍스트와 동일한 맥락에 속하게 됩니다. 이는 텍스트 AI가 접근할 수 없는 작업을 열어줍니다. 즉, 손으로 쓴 메모를 분석하고, 스크린샷에서 표를 꺼내고, 사진의 문제점을 이해하는 것입니다. 멀티모달리티(Multimodality)는 세상을 읽기만 하는 것이 아니라 세상을 보는 AI입니다.

평가 방법 · 합격 70

  • 1주변에 텍스트가 없는 유효한 JSON30%
  • 2suitable 및 how 필드가 있습니다.35%
  • 3예 - 사진 표시, 필드를 구조로 추출35%
귀하의 프롬프트Claude ⌄