Назад к дайджесту
Reddit

Deepseek V4 Flash появился на Colibri: пользователи ищут бенчмарки

Пользователи обсуждают производительность новой модели Deepseek V4 Flash на платформе Colibri. Интересуют требования к VRAM (128-192 ГБ), поддержка квантования FP4, скорость генерации для агентных рабочих нагрузок и работа с контекстом свыше 200k токенов.

score 40r/LocalLLaMA