Reddit
Какое железо используют для Qwen3.6 35B с 1000+ префиллом и 100+ декодом в Q4?
Пользователь делится опытом локального запуска Qwen3.6 35B на RX6600XT + Ryzen 7 5700X с 32GB RAM, достигая 270-300 t/s префилл и ~30 t/s декод. Обсуждает настройки llama.cpp с ROCm, проблемы с оптимизацией GPU-слоёв и нехватку скорости для голосовых интерфейсов.
score 40r/LocalLLaMA