GitHub
laya-mlx: нативный MLX-рантайм для моделей принятия решений Laya
Представлен нативный MLX-рантайм для типизированных моделей принятия решений Laya. Он обеспечивает выполнение коротких решений за 7–14 мс на чипе M3 Max, без генерации текста, PyTorch и облачных API.
4.3k287 forksPythonscore 86.3
modernbertdecision-modelinferencemlxapple-siliconlocal-aimachine-learningsystem-onelayatyped-decisions