Назад к дайджесту
Reddit

Бенчмарки Vulkan llama.cpp: Radeon RX 7900 GRE 16GB и RX 480 8GB

Пользователь протестировал связку из двух видеокарт AMD (RX 7900 GRE 16GB и RX 480 8GB) для запуска LLM через llama.cpp с Vulkan-бэкендом. Приведены результаты для моделей размером до 27B: показатели токенов в секунду для обработки промпта и генерации, включая сравнение с включённым и выключенным Flash Attention. Отмечается, что RX 7900 GRE испытывает трудности с моделями крупнее 20B, а добавление RX 480 помогает распределить нагрузку.

score 55r/LocalLLaMA