Reddit
Бенчмарк: MindControl для Llama.cpp
Представлены результаты тестирования PoC MindControl, интегрированного в llama.cpp. Метод использует управляемые бюджеты рассуждений на уровне сэмплера, позволяя сократить потребление токенов до 50% без потери качества на задачах HumanEval+ и LiveCodeBench. Тестирование на Qwen3.6-27B показало, что продвинутые настройки даже превзошли базовый вариант по точности.
score 55r/LocalLLaMA