Reddit
Deepseek V4 Flash появился на Colibri: пользователи ищут бенчмарки
Пользователи обсуждают производительность новой модели Deepseek V4 Flash на платформе Colibri. Интересуют требования к VRAM (128-192 ГБ), поддержка квантования FP4, скорость генерации для агентных рабочих нагрузок и работа с контекстом свыше 200k токенов.
score 40r/LocalLLaMA