Назад к дайджесту
GitHub

vllm.cpp — C++-реализация движка vLLM

Сообщество разработало C++-версию популярного движка для инференса LLM vLLM с поддержкой continuous batching и paged KV cache. Проект предлагает альтернативу оригинальной Python-реализации с потенциальными преимуществами в производительности и интеграции.

445 forksC++score 79.2
llmvllmmlxcpp20