Назад к дайджесту
Reddit

Какой LLM вы бы доверили роль «исправлятеля» в автономном агенте для ремонта кода?

Пользователь спрашивает сообщество о выборе LLM для автономного агента, исправляющего код в продакшене (Python-монолит, извлечение финансовых данных из PDF). Агент работает до 60 шагов, бюджет $30-50 за запуск, и важна честная оценка «не могу исправить» вместо галлюцинированных патчей. Автор хочет услышать опыт длительных агентных сессий (50+ шагов, 100K+ токенов) и сравнения на реальных упавших задачах, а не на SWE-bench.

score 40r/ClaudeAI