Назад к дайджесту
Reddit

Бенчмарк: MindControl для Llama.cpp

Представлены результаты тестирования PoC MindControl, интегрированного в llama.cpp. Метод использует управляемые бюджеты рассуждений на уровне сэмплера, позволяя сократить потребление токенов до 50% без потери качества на задачах HumanEval+ и LiveCodeBench. Тестирование на Qwen3.6-27B показало, что продвинутые настройки даже превзошли базовый вариант по точности.

score 55r/LocalLLaMA