Назад к дайджесту
GitHub

laya-mlx: нативный MLX-рантайм для моделей принятия решений Laya

Представлен нативный MLX-рантайм для типизированных моделей принятия решений Laya. Он обеспечивает выполнение коротких решений за 7–14 мс на чипе M3 Max, без генерации текста, PyTorch и облачных API.

4.3k287 forksPythonscore 86.3
modernbertdecision-modelinferencemlxapple-siliconlocal-aimachine-learningsystem-onelayatyped-decisions