Назад к дайджесту
Новость

Турнир семи нейросетей: модели судили друг друга в 3360 битвах

Автор провёл практическое сравнение семи языковых моделей (GPT, Claude и другие через OpenRouter) для задачи генерации сайтов. Вместо синтетических бенчмарков модели оценивали реальные результаты работы друг друга с первого промпта — то, что важно для заказчиков.