Reddit
Обвязка агента важнее выбора модели
Автор утверждает, что инфраструктура вокруг модели — так называемый харнес — влияет на результат агента сильнее, чем выбор самой LLM. На примере SWE-bench Pro показано, что одна и та же модель может показывать разницу в 10–20% баллов только за счёт изменений в коде обвязки. Надежность и производительность агентов зависят от качества управления контекстом и инструментами, а не только от веса модели.
score 40r/AI_Agents