Reddit
Запуск Qwen3.8-27B на двух RTX 3060: бенчмарк и конфигурация
Автор делится опытом запуска языковой модели Qwen3.8-27B в квантованном формате Q4_K_M на системе с двумя видеокартами RTX 3060 с использованием llama.cpp. Приведены реальные метрики производительности, показывающие скорость обработки промпта и генерации токенов в условиях ограниченных ресурсов.
score 40r/LocalLLaMA