Назад к дайджесту
Reddit

По данным Agent Arena Kimi K3 сравнялась с Opus в задачах мышления

Пользователи Reddit обсуждают результаты бенчмарка Agent Arena, где модель Kimi K3 показала результаты, сопоставимые с Claude 3 Opus в текстовых задачах. Отмечается, что в задачах с компьютерным зрением Opus может превосходить конкурента, но в чистом тексте модели равны. Обсуждение касается сравнения возможностей различных языковых моделей.

score 40r/LocalLLaMA