Назад к дайджесту
Reddit

Кто-нибудь реально измерял, как надёжность агента меняется с длиной траектории?

Пользователь ищет данные о том, как длина траектории (количество шагов) влияет на надёжность ИИ-агентов: успешность, точность вызовов инструментов, стоимость и необходимость вмешательства человека. Он отмечает, что на практике длинные многошаговые сценарии приводят к ошибкам, но не находит бенчмарков, которые изолированно изучали бы этот фактор. Автор интересуется, есть ли исследования, отделяющие влияние длины от проблем с памятью, оркестрацией и повторами.

score 40r/AI_Agents