Reddit
Какие паттерны верификации вы используете для агентов, которые вызывают инструменты или автоматизируют браузеры?
Автор обсуждает проблемы галлюцинаций у агентов, которые пишут код, вызывают инструменты или выполняют действия в браузере. Он предлагает разделить актора и верификатора, где верификатор — детерминированный код без LLM, проверяющий валидность выходных данных по чётким правилам. Также рекомендуются структурированные выходы (JSON), хранение артефактов для каждого побочного эффекта и ограничение количества вызовов, стоимости и времени выполнения. Автор спрашивает сообщество о практиках верификации и самых рискованных агентах.
score 40r/AI_Agents