Назад к дайджесту
Reddit

Мы перестали отправлять все запросы ИИ-агента в Claude Opus 5. Результаты нас удивили.

Разработчики протестировали стратегию маршрутизации запросов ИИ-агента между разными моделями вместо использования единой флагманской модели. Эксперимент на 89 задачах Terminal-Bench 2.1 показал, что разделение этапов работы между моделями может быть эффективнее, чем использование одного Claude Opus 5. Результаты исследования вызвали удивление у команды.

score 55r/AI_Agents