Reddit
Какая версия Qwen 3.6 или 3.8 27B лучше для задач без мышления?
Пользователь Reddit сравнивает «аблитерированные» (с удалённой безопасностью) версии языковых моделей Qwen 3.6 и 3.8 на 27B параметров для задач с отключённым мышлением. Обсуждаются квантованные варианты (NVFP4, GGUF) для локального запуска на GPU с 24GB VRAM и поиск оптимальной по скорости модели.
score 40r/LocalLLaMA