Reddit
Призыв к вычислительным ресурсам — помогите оптимизировать скорость инференса Qwen на локальном железе
Автор переименовал репозиторий в HyperQwen, чтобы сосредоточиться на моделях Qwen и локальном оборудовании. Он ищет владельцев GPU 4090/5090 (Windows и Linux) для тестирования скорости декодирования и префилла перед запуском Qwen4. У самого автора только RTX 3090, поэтому нужна помощь сообщества.
score 40r/LocalLLaMA