Назад к дайджесту
Reddit

Сравнение бенчмарков ThinkingCap 3.8-27B, Swift 3.8-27B и Qwen 3.8-27B

Автор сравнивает оригинальную модель Qwen3.8-27B с двумя её доработанными версиями — ThinkingCap и Swift, которые обещают сократить избыточные циклы рассуждений примерно на 40% с минимальной потерей качества. По результатам тестов на наборе Aider, ThinkingCap и базовая модель показали идентичные результаты, а Swift — чуть ниже, но с более высоким процентом успеха с первой попытки. Главное отличие — почти на 5 тысяч меньше токенов завершения у обеих доработанных моделей, что подтверждает заявленное сокращение.

score 40r/LocalLLaMA