Reddit
Минимальная видеопамять GPU для запуска DeepSeek-V4-Flash-0731 Q4_K_XL со скоростью около 30 т/с?
Пользователь спрашивает о минимальном объеме видеопамяти для локального запуска модели DeepSeek-V4-Flash-0731 в квантовании Q4_K_XL. Интересует производительность около 30 токенов в секунду, учитывая архитектуру MoE с 13B активных параметров.
score 40r/LocalLLaMA