Назад к дайджесту
Reddit

Призыв к вычислительным ресурсам — помогите оптимизировать скорость инференса Qwen на локальном железе

Автор переименовал репозиторий в HyperQwen, чтобы сосредоточиться на моделях Qwen и локальном оборудовании. Он ищет владельцев GPU 4090/5090 (Windows и Linux) для тестирования скорости декодирования и префилла перед запуском Qwen4. У самого автора только RTX 3090, поэтому нужна помощь сообщества.

score 40r/LocalLLaMA