Reddit
Собрал вчера с помощью Qwen3.8-Flash-Next (NVFP4, 262K контекст) на одном NVIDIA DGX Spark
Пользователь сообщает, что за 8 часов с помощью Qwen3.8-Flash-Next (NVFP4, 262K контекст) на одном NVIDIA DGX Spark создал проект, сгенерировав около 10 тысяч строк кода и потребив примерно 800 тысяч токенов. Отмечает, что модель работает локально со скоростью около 35 токенов в секунду.
score 55r/LocalLLaMA