LearnAI
Новинки AI · Безопасный AI · レッスン 3/10
← カタログへ
タスク

AI フィクションを認識する方法

AI の応答を解析します。 JSON を返す {"red_flags":[...],"suspicious_claim":"...","verify_step":"..."}: red_flags - この回答にフィクションの可能性がある兆候。 suspicious_claim - 最も疑わしい声明。 verify_step - モデル外で確認する方法。 JSON のみを返し、周囲のテキストは返しません。

アクセスのロックを解除して、AI による即時レビューのためにソリューションを送信します。
幻覚をキャッチする
💡 理論の一部

仕組み: テキスト ジェネレーターは、真実かどうかを確認するのではなく、確率に基づいて次の単語を予測します。したがって、彼は自信を持って、存在しない本、引用、統計、リンク、裁判例など、存在しないものを発明します。これは「嘘」ではありません。モデルは単にもっともらしい方法でギャップを埋めているだけです。危険信号: 出典のない正確すぎる数字、狭いトピックの特定の日付、巻数、ページ、開かれていない「リンク」、専門家が議論する自信に満ちた内容。テクニック: 事実 (法律の番号、記事のページ、著者との引用) がニッチで検証可能であればあるほど、発明の可能性が高くなります。モデルが最も簡単に思いつくのはその詳細です。 2 番目のトリック: 同じ質問を異なる方法で 2 回尋ねます。「事実」に関する答えが異なる場合、これは知識ではなくフィクションの兆候です。インサイダー: 幻覚は、明らかに奇妙な場所ではなく、長い答えのもっともらしい途中に隠れていることがよくあります。典型的な間違いは、自信があり有能に聞こえるという理由だけで答えを信頼することです。スタイルは真実と同じではありません。

どのように評価されますか? 合格 70

  • 1周囲にテキストのない有効な JSON20%
  • 2red_flags、suspicious_claim、verify_step のフィールドがあります30%
  • 3署名と検証は例にリンクされています50%
あなたのプロンプトClaude ⌄
🔒

アクセスのロックを解除して、AI による即時レビューのためにソリューションを送信します。