Reddit
LessThink-Qwen3-4B: та же модель, но с гораздо меньшими затратами на рассуждение
Исследователь провел пост-обучение модели Qwen3-4B для сокращения количества токенов, используемых на этапе логического вывода, на 44%, сохранив при этом качество знаний и стиль ответов. Вся процедура оптимизации была выполнена на одном GPU.
score 40r/MachineLearning