Назад к дайджесту
Reddit

DeepSeek-V4-Flash: новая квантованная сборка GGUF от Antirez

Antirez выложил на Hugging Face веса модели DeepSeek-V4 в формате GGUF с продвинутыми оптимизациями. Включены специфические квантования (Q4K, Q8) и модули для ускорения внимания и экспертов. Это позволяет эффективно запускать модель локально с минимальными потерями качества.

score 40r/LocalLLaMA