GitHub
peonist-ai/halogen-flash-server — быстрый запуск Qwen3.8-Flash-Next на Strix Halo
Репозиторий предлагает оптимальный способ запуска модели Qwen3.8-Flash-Next на платформе Strix Halo (gfx1151). Проект ориентирован на ускорение инференса и упрощение развертывания LLM на указанном оборудовании.
1167 forksShellscore 79.2
qwenopenai-apiinference-engineradeonlocal-llmrocmllm-servingamdspeculative-decodingryzen-ai