LearnAI
모듈 7 · AI 품질평가점수(프로) · 수업 1/5
← 카탈로그로

테스트 세트(평가 세트)

평가 키트를 조립하는 방법과 그 이유는 무엇입니까? JSON {"steps": [2개 이상의 단계 목록], "why": "short"}를 반환합니다.

즉각적인 AI 검토를 위해 솔루션을 제출할 수 있는 액세스 권한을 잠금 해제하세요.무료로 시작하세요
AI 품질 기반
💡 이론의 일부

평가 세트는 각 변경 전에 시스템을 실행하는 예상 결과가 포함된 대표적인 예제 세트입니다. 그것이 없으면 프롬프트를 개선하는 것은 운세입니다. 하나의 사례를 수정하고 조용히 5개의 사례를 깨뜨렸습니다. 수집 방법: 일반적인 사례와 극단적 사례를 포괄하는 실제(또는 실제에 가까운) 입력을 가져옵니다. 정답이거나 허용 가능한 답변을 기록합니다. 각 편집 전후에 전체 세트를 실행하고 완료율을 비교하십시오. 20-50개의 좋은 사례라도 개발을 근본적으로 변화시킵니다. 회귀가 눈에 띕니다. 규칙: 평가할 세트가 없으면 시스템을 개선할 수 없으며 오류를 이리저리 옮기기만 할 뿐입니다.

평가 방법 · 합격 70

  • 1주변에 텍스트가 없는 유효한 JSON30%
  • 2steps 및 why 배열이 있습니다.35%
  • 32개 이상의 단계: 예시 수집, 답변 기록, 이전/이후 실행35%
귀하의 프롬프트Claude ⌄