Назад к дайджесту
Reddit

Ling-3.0-flash: SGLang обещает поддержку с первого дня, vLLM ждёт открытия весов, а llama.cpp отказал в интеграции

Разработчики отслеживают статус поддержки модели Ling-3.0-flash в популярных фреймворках для инференса. SGLang и vLLM подтвердили планы по интеграции, но llama.cpp отказался добавлять поддержку архитектуры Bailing MoE. Открытие весов и лицензий пока не произошло, что сдерживает быструю доступность.

score 55r/LocalLLaMA