Reddit
Если используете llama.cpp, обновите чат-шаблон для DeepSeek-V4
В библиотеке llama.cpp обнаружена ошибка, нарушающая поведение preserve_thinking для старых версий моделей DeepSeek-V4 в формате gguf. Это делает модель менее эффективной в задачах кодинга. Решение — принудительная подмена шаблона через параметр --chat-template-file.
score 55r/LocalLLaMA