Назад к дайджесту
Reddit

Ускорение запуска Qwen3.8+Flash-Next и мини-моделей на Apple Silicon в 3 раза

Оптимизация позволяет запускать языковые модели Qwen и другие компактные архитектуры на чипах Apple Silicon с увеличением скорости до трех раз. Упоминается использование библиотеки MLX.fast, которая демонстрирует высокие результаты производительности на процессорах серии M.

score 40r/LocalLLaMA