Reddit
Бенчмарк DeepSeek V4 Flash 0731 при локальном запуске
Пользователь обновил локальный бенчмарк с квантованной версией MXFP4 модели DeepSeek V4 Flash. Модель показывает высокую эффективность: 1K токенов/сек при префилле и 90 токенов/сек при генерации, но не поддерживает vision.
score 40r/LocalLLaMA