Reddit
Сравнение локальных AI-движков: oMLX, Rapid-MLX, Splash и MTPLX на M3 Max
Тестирование скорости локального вывода четырех популярных MLX-движков на MacBook Pro с чипом M3 Max. Результаты показывают, что Rapid-MLX лидирует на моделях архитектуры MoE (до 118 токенов/с), а Splash и MTPLX демонстрируют лучшие показатели на плотных моделях (до 52 токенов/с).
score 40r/LocalLLaMA