Новость
Турнир семи нейросетей: модели судили друг друга в 3360 битвах
Автор провёл практическое сравнение семи языковых моделей (GPT, Claude и другие через OpenRouter) для задачи генерации сайтов. Вместо синтетических бенчмарков модели оценивали реальные результаты работы друг друга с первого промпта — то, что важно для заказчиков.