Reddit
Как команды проверяют изменения в поведении AI-агентов после ошибок в тестах
Автор обсуждает рабочие процессы валидации правок промптов, правил инструментов и guardrails, выявленных через трейсы и оценки. Рассматриваются варианты интеграции проверок в PR, дашборды или специализированные инструменты версионирования. Цель — найти оптимальную структуру для предложений по изменениям, основанных на доказательствах, чтобы избежать избыточной бюрократии.
score 40r/AI_Agents