Reddit
Какой сейчас оптимальный способ запуска Qwen3.8-Flash-Next на паре 3090 с большим объемом оперативной памяти?
Пользователь ищет актуальный рецепт запуска модели Qwen3.8-Flash-Next на двух GPU (A30/3090, 24 ГБ VRAM) с использованием tensor parallel и большого объема системной памяти. Упоминается HPC-кластер из 70 узлов с 1 ТБ DDR4 RAM на каждом.
score 40r/LocalLLaMA