Оціни ризик завдання та придумай захист від помилок агента. Поверни JSON {"task":"...","riskLevel":"...","riskyPoint":"...","safeguard":"..."}: task - задача, riskLevel - один з: низький, середній, високий ∧ ймовірна вигадка чи незворотна дія), safeguard — як ти це перевіриш.
Агенти мають передбачувані слабкі місця, і знання їх — половина успіху. Перше: впевнений тон при вигадці. Якщо фактів не вистачає, агент все одно дасть гладку відповідь просто вигаданий. Друге: зациклювання - він може ходити колами, повторюючи один крок, якщо ціль розмита. Третє: неправильне припущення на початку, через яке вся робота йде не туди. Механіка захисту будується на перевірці. Інсайдерський прийом: вимагай посилання на джерело для кожного важливого затвердження та пряму позначку невпевненості — «якщо не впевнений, то й напиши». Вигадку легше спіймати, коли поряд має бути посилання. Другий прийом — бюджет кроків і окремий крок перевірки: «зроби, потім перевіряти ще раз результат за цим критерієм». Обмеження кроків не дає піти у безкінечний цикл. Типова помилка — довіряти відповіді через його впевнений вигляд та переконливі деталі. Переконливість і справді — різні речі. Оцінюй ризик завдання заздалегідь: чим він вищий, тим суворіша перевірка і тим менше автономії варто давати агенту.
Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.