Назад к дайджесту
Reddit

Qwen3.8 27b для агентного программирования и что дальше?

Пользователь делится опытом использования локальной модели Qwen3.8 27b (квантование UD Q4_K_XL) на RTX 3090 с 24 ГБ VRAM, отмечая её высокую производительность для агентного кодинга и предполагая, что такие компактные локальные модели могут составить конкуренцию коммерческим API от Anthropic и OpenAI. Автор также обсуждает проблему выбора следующей, более мощной модели: Kimi-K3 недоступна для большинства, а MiniMax-M3 требует серьезного железа (96–192 ГБ VRAM), и задается вопросом о целесообразности покупки GPU-сервера для достижения скорости более 30 токенов в секунду.

score 40r/LocalLLaMA