Reddit
Qwen 3.8 Next Flash стал невероятно многословным: 13 минут размышлений на один запрос
Пользователь, перешедший с Qwen 3.6 27b на Next Flash, жалуется на чрезмерную многословность модели: до 13 минут «размышлений» на один запрос по кодингу. При этом качество ответов страдает — при задачах, требующих принятия решений, модель генерирует «алфавитный суп» из жаргона, а время выполнения в pi.dev достигает часа. Автор не хочет снижать уровень thinking, опасаясь ухудшения качества, и отмечает отсутствие бенчмарков для разных уровней.
score 40r/LocalLLaMA