GitHub
Atlas Inference: легкий движок для запуска LLM без зависимостей
Atlas Inference — это легковесный движок вывода для больших языковых моделей, не требующий сторонних зависимостей. Проект оптимизирован для бесшовного запуска на локальном оборудовании, включая архитектуры GB10 и Strix Halo.
307 forksRustscore 71.2
inferenceaiinference-enginellm