Назад к дайджесту
Reddit

Квантованная версия Qwen 3.8 Flash для одночиповых систем

Разработчик выложил квантованную версию модели Qwen 3.8 Flash, сохраняющую 95% точности по сравнению с версией FP16. Модель поддерживает длинные контексты до 256k токенов и позиционируется для эффективного запуска на ограниченном оборудовании.

score 40r/LocalLLaMA