Reddit
Ускорение запуска Qwen3.8+Flash-Next и мини-моделей на Apple Silicon в 3 раза
Оптимизация позволяет запускать языковые модели Qwen и другие компактные архитектуры на чипах Apple Silicon с увеличением скорости до трех раз. Упоминается использование библиотеки MLX.fast, которая демонстрирует высокие результаты производительности на процессорах серии M.
score 40r/LocalLLaMA