Reddit
Qwen3.8-27B-Uncensored-Genesis-V1-GGUF
Автор представляет модель Qwen3.8-27B-Uncensored-Genesis-V1-GGUF, созданную для решения проблемы избыточного расхода токенов при рассуждениях LLM. Он предполагает, что причина — числовая нестабильность тензоров из-за накопления шума обучения, и использует распределение Марченко-Пастура для дистилляции шума. Модель доступна для тестирования сообществом.
score 40r/LocalLLaMA