Reddit
Оптимизированная для 24 ГБ видеопамяти модель Qwen3.8-27B для кодинга с высокой скоростью генерации
Разработчик выпустил квантованную и обученную на коде версию модели Qwen3.8-27B, оптимизированную для работы на GPU с 24 ГБ памяти (например, AMD RX 7900 XTX). Модель использует технику MTP для быстрого черновика, обеспечивая скорость 36–41 токен/сек и высокий процент принятия черновых токенов, что делает её эффективной для агентов программирования.
score 55r/LocalLLaMA