Новость
Дело о лишних размышлениях: почему вредно много думать
Автор тестирует локальную модель Qwen3.8-27B на Mac Studio и обнаруживает, что включение максимального уровня рассуждений (reasoning_effort=xhigh) не улучшает, а ухудшает качество ответов на сложных задачах. Вместо ожидаемого повышения точности модель уходит в бесконечные размышления и не может решить задачу. Статья исследует, как найти баланс между скоростью и качеством работы квантизованных версий модели.