Reddit
Стоит ли переходить с двух RTX 2060 12GB на RX 6800 + 6800 XT для llama.cpp?
Пользователь рассматривает апгрейд с двух RTX 2060 12GB (24GB VRAM) на связку RX 6800 и RX 6800 XT (32GB VRAM) для запуска llama.cpp. Он отмечает, что на текущей системе с Qwen3.8 27B IQ4_XS получает около 45 ток/с, и сомневается, насколько хорошо AMD-карты покажут себя в смешанной multi-GPU конфигурации, особенно с учётом неоднозначных отзывов о ROCm и Vulkan. Вопрос сводится к тому, будет ли апгрейд значимым или просто добавит VRAM для более высоких квантизаций и длинного контекста.
score 55r/LocalLLaMA