Reddit
Объединение моделей Qwen3.6 и 3.8 27B для повышения эффективности генерации
Предлагается метод объединения весов моделей Qwen3.6 и Qwen3.8 размером 27B параметров для достижения достойного качества работы при значительном сокращении количества генерируемых токенов. Подход направлен на оптимизацию производительности языковых моделей без потери функциональности.
score 40r/LocalLLaMA