Reddit
Квантованная версия Qwen 3.8 Flash для одночиповых систем
Разработчик выложил квантованную версию модели Qwen 3.8 Flash, сохраняющую 95% точности по сравнению с версией FP16. Модель поддерживает длинные контексты до 256k токенов и позиционируется для эффективного запуска на ограниченном оборудовании.
score 40r/LocalLLaMA