Reddit
По данным Agent Arena Kimi K3 сравнялась с Opus в задачах мышления
Пользователи Reddit обсуждают результаты бенчмарка Agent Arena, где модель Kimi K3 показала результаты, сопоставимые с Claude 3 Opus в текстовых задачах. Отмечается, что в задачах с компьютерным зрением Opus может превосходить конкурента, но в чистом тексте модели равны. Обсуждение касается сравнения возможностей различных языковых моделей.
score 40r/LocalLLaMA