Reddit
Opus 4.8 набрала 92,3 в бенчмарке из 17 моделей: 4 ИИ превзошли результат
Опубликованы результаты закрытого бенчмарка 17 языковых моделей, оценивающих их способности в стратегическом мышлении, консультировании, генерации текста и критике. Opus 4.8 заняла пятое место с итоговым баллом 92,3, уступив четырем моделям, включая вариации GPT-5.6. Автор указывает на ограничения выборки и методологию оценки, где референсом выступала модель Fable 5.
score 40r/ClaudeAI