Назад к дайджесту
Reddit

Почему лучшие открытые модели набирают относительно низкие баллы в индексе AA-Omniscience

Пользователь Reddit обсуждает неожиданно низкие результаты современных открытых моделей с открытыми весами в бенчмарке AA-Omniscience Index, особенно в сравнении с моделями Gemini-3.* Flash. Автор отмечает, что хотя результаты не катастрофически низкие, разрыв с проприетарными моделями вызывает удивление и вопросы о методологии оценки.

score 40r/LocalLLaMA