Reddit
Инструкции в промптах не спасли агентов — помогли только проверки на уровне вызовов инструментов
Автор описывает четыре паттерна жестких проверок (guardrails) для AI-агентов, которые превосходят обычные текстовые инструкции в системном промпте. Ключевая идея — валидировать аргументы инструментов и последовательность действий до их выполнения, а не полагаться на «просьбы» к модели. Приводятся примеры защиты от опасных операций (например, rm -rf) и управления бюджетом через предварительное резервирование лимитов.
score 40r/AI_Agents