LearnAI
Новинки AI · AI-агенты · Урок 7/10
← К каталогу
Задача

Где агент ошибается

Оцени риск задачи и придумай защиту от ошибок агента. Верни JSON {"task":"...","riskLevel":"...","riskyPoint":"...","safeguard":"..."}: task — задача, riskLevel — один из: низкий, средний, высокий, riskyPoint — самое опасное место (где вероятна выдумка или необратимое действие), safeguard — как ты это проверишь.

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.
Ловить ошибки агента
💡 Кусочек теории

У агентов есть предсказуемые слабые места, и знание их — половина успеха. Первое: уверенный тон при выдумке. Если фактов не хватает, агент всё равно даст гладкий ответ — просто выдуманный. Второе: зацикливание — он может ходить кругами, повторяя один шаг, если цель размыта. Третье: неверное допущение в начале, из-за которого вся работа уходит не туда. Механика защиты строится на проверке. Инсайдерский приём: требуй ссылку на источник для каждого важного утверждения и прямую пометку неуверенности — «если не уверен, так и напиши». Выдумку легче поймать, когда рядом должна быть ссылка. Второй приём — бюджет шагов и отдельный шаг проверки: «сделай, потом перепроверь результат по этому критерию». Ограничение шагов не даёт уйти в бесконечный цикл. Типичная ошибка — доверять ответу из-за его уверенного вида и убедительных деталей. Убедительность и правда — разные вещи. Оценивай риск задачи заранее: чем он выше, тем строже проверка и тем меньше автономии стоит давать агенту.

Как оценивается · проходной 70

  • 1Валидный JSON без текста вокруг15%
  • 2Есть нужные поля20%
  • 3riskLevel — одно из допустимых значений15%
  • 4Опасное место названо, защита реальна50%
Твой промптClaude ⌄
🔒

Открой доступ, чтобы отправлять решения на мгновенную AI-проверку.