Назад к дайджесту
Reddit

Собрал вчера с помощью Qwen3.8-Flash-Next (NVFP4, 262K контекст) на одном NVIDIA DGX Spark

Пользователь сообщает, что за 8 часов с помощью Qwen3.8-Flash-Next (NVFP4, 262K контекст) на одном NVIDIA DGX Spark создал проект, сгенерировав около 10 тысяч строк кода и потребив примерно 800 тысяч токенов. Отмечает, что модель работает локально со скоростью около 35 токенов в секунду.

score 55r/LocalLLaMA