Reddit
Запуск Qwen3.8-27B на RTX 3090: производительность, кодирование и ограничения рассуждений
Автор тестирует локальный запуск модели Qwen3.8-27B в квантовании Q4_K_M на видеокарте RTX 3090 с использованием llama.cpp и агента OpenCode. Приведены данные о пропускной способности при различных длинах контекста и результаты выполнения четырех задач по написанию кода на Python. Отмечены успешные результаты генерации кода, но также зафиксирован сбой в задачах, требующих сложных рассуждений с ограниченным бюджетом токенов.
score 40r/LocalLLaMA