Reddit
DeepSeek-V4-Flash: новая квантованная сборка GGUF от Antirez
Antirez выложил на Hugging Face веса модели DeepSeek-V4 в формате GGUF с продвинутыми оптимизациями. Включены специфические квантования (Q4K, Q8) и модули для ускорения внимания и экспертов. Это позволяет эффективно запускать модель локально с минимальными потерями качества.
score 40r/LocalLLaMA