GitHub
OpenBench: бенчмарк обёрток для AI-агентов на одной модели
Проект OpenBench проводит сравнительный анализ различных обёрток для кодинговых агентов (Cursor, Devin, OpenCode) на базе единой модели. Оценка проводится по критериям корректности, скорости и стоимости токенов, что позволяет изолировать влияние интерфейса от качества самой модели. Ресурс полезен для разработчиков, выбирающих инструменты для автоматизации кодинга.
1143 forksPythonscore 78.9
benchmarkcoding-agentsllmevalsopen-modelsai-agents