Назад к дайджесту
Reddit

Объединение моделей Qwen3.6 и 3.8 27B для повышения эффективности генерации

Предлагается метод объединения весов моделей Qwen3.6 и Qwen3.8 размером 27B параметров для достижения достойного качества работы при значительном сокращении количества генерируемых токенов. Подход направлен на оптимизацию производительности языковых моделей без потери функциональности.

score 40r/LocalLLaMA