Назад к дайджесту
Reddit

Быстрое сравнение производительности ROCm и Vulkan с DSv4 Flash 0731 и Qwen 3.8 Flash Next на R9700+Strix Halo в llama.cpp

Пользователь сравнил производительность двух моделей — DeepSeek v4 Flash 0731 и Qwen 3.8 Flash Next — на своём железе (R9700+Strix Halo) с бэкендами ROCm и Vulkan в llama.cpp. После обновления ядра, драйверов, ROCm и Mesa, а также множества улучшений в llama.cpp, ROCm по-прежнему выигрывает для Deepseek, но Vulkan значительно сократил разрыв. Для Qwen ROCm быстрее в обработке промпта, а Vulkan — в генерации токенов.

score 55r/LocalLLaMA