Назад к дайджесту
Reddit

Какой сейчас оптимальный способ запуска Qwen3.8-Flash-Next на паре 3090 с большим объемом оперативной памяти?

Пользователь ищет актуальный рецепт запуска модели Qwen3.8-Flash-Next на двух GPU (A30/3090, 24 ГБ VRAM) с использованием tensor parallel и большого объема системной памяти. Упоминается HPC-кластер из 70 узлов с 1 ТБ DDR4 RAM на каждом.

score 40r/LocalLLaMA