Назад к дайджесту
Reddit

Запуск Qwen3.8-27B на двух RTX 3060: бенчмарк и конфигурация

Автор делится опытом запуска языковой модели Qwen3.8-27B в квантованном формате Q4_K_M на системе с двумя видеокартами RTX 3060 с использованием llama.cpp. Приведены реальные метрики производительности, показывающие скорость обработки промпта и генерации токенов в условиях ограниченных ресурсов.

score 40r/LocalLLaMA