LearnAI
Новинки AI · Безопасный AI · 수업 4/10
← 카탈로그로

AI가 "모르겠어요"라고 말하게 하세요

조작에 대해 요청하십시오. JSON 반환 {"prompt":"...","rules":[...],"why_works":"..."}: prompt — AI에 대한 요청 텍스트; rules — 무지한 경우의 행동 규칙이 요청에 내장되어 있습니다. why_works - 이것이 퍼지를 줄이는 이유를 간단히 설명합니다. JSON만 반환하고 주위에 텍스트는 반환하지 않습니다.

즉각적인 AI 검토를 위해 솔루션을 제출할 수 있는 액세스 권한을 잠금 해제하세요.
프롬프트 대 허구
💡 이론의 일부

역학: 기본적으로 모델은 데이터가 없더라도 "도움을 주기 위해 노력"하고 텍스트를 계속합니다. 침묵은 옵션이 아닐 가능성이 높습니다. 이는 모르는 것에 대한 허가가 명시적으로 주어져야 함을 의미합니다. 신속한 기술: (1) 직접적인 지시 - "잘 모르겠으면 '모르겠어요'라고 솔직하게 말하고 꾸며내지 마세요." (2) 출처 요구 사항 - "출처와 함께 이름을 지정할 수 있는 사실만 제공하고 나머지는 가정으로 표시"합니다. (3) 분리 - "검증된 사실을 추측과 분리합니다." 내부자: 모델에게 신뢰도를 백분율로 추정하고 정확히 무엇을 모르는지 설명하도록 요청합니다. 이렇게 하면 작업이 "답변 제공"에서 "신뢰성 평가"로 변경되기 때문에 자신감 있는 조작이 급격히 줄어듭니다. 두 번째 요령: 기본 가정 없이 질문을 공식화합니다. "법칙 X가 존재합니까?" "법칙 X를 다시 말함" 대신 그렇지 않으면 모델은 존재하지 않는 것을 확인하게 됩니다. 전형적인 실수: "실수하지 마세요"라는 정중한 말이 효과가 있다고 믿는 것입니다. 우리는 정확함을 요구하기보다는 무지에 직면한 행동에 대한 구체적인 규칙이 필요합니다.

평가 방법 · 합격 70

  • 1주변에 텍스트가 없는 유효한 JSON20%
  • 2prompt, rules, why_works 필드가 있습니다.30%
  • 3탐구는 정말로 무지를 해결해 준다50%
귀하의 프롬프트Claude ⌄
🔒

즉각적인 AI 검토를 위해 솔루션을 제출할 수 있는 액세스 권한을 잠금 해제하세요.