Reddit
Почему лучшие открытые модели набирают относительно низкие баллы в индексе AA-Omniscience
Пользователь Reddit обсуждает неожиданно низкие результаты современных открытых моделей с открытыми весами в бенчмарке AA-Omniscience Index, особенно в сравнении с моделями Gemini-3.* Flash. Автор отмечает, что хотя результаты не катастрофически низкие, разрыв с проприетарными моделями вызывает удивление и вопросы о методологии оценки.
score 40r/LocalLLaMA