Как обезопасить действия по выводу модели? Верни JSON {"safeguards": [список из 2+ предохранителей], "why": "кратко"}.
AI не жмёт на кнопки вслепуюОпасно, когда вывод модели напрямую запускает действие (удаление, платёж, исполнение кода, рассылка) без проверки. Модель может ошибиться или быть подставлена. Предохранители: валидируй и ограничивай сгенерированную команду (белый список операций, запрет разрушительных); подтверждение человеком для необратимых действий (human-in-the-loop); песочница и минимальные права на исполнение; лимиты (сколько и чего можно сделать за раз). Автономность удобна, но необратимое действие без проверки — катастрофа, ждущая случая. Правило: между выводом модели и реальным действием всегда стоит проверка; необратимое — только через подтверждение.