Ollama v0.40.0 включает автоматический запуск моделей через MLX на Apple Silicon
В релизе Ollama v0.40.0 поддерживаемые архитектуры на устройствах Apple Silicon по умолчанию запускаются через MLX. Также runtime получил поддержку embedding-модели.

Ollama выпустила v0.40.0 с изменением для компьютеров Apple Silicon. Если архитектура модели поддерживается runtime MLX, Ollama теперь автоматически запускает её через MLX. Пользователям не нужно отдельно переключать этот runtime для таких моделей.
В релизе также указана поддержка embedding-модели embeddinggemma-2. Кроме того, авторы добавили новые модели и продолжили расширять список совместимых вариантов. Отдельно отмечена поддержка decision-моделей в MLX.
Практическое значение обновления — более простой запуск поддерживаемых моделей на Apple Silicon и расширение сценариев, доступных через MLX. Изменения относятся к версии v0.40.0 и опубликованы в официальном репозитории Ollama.
Почему это важно
Обновление меняет поведение Ollama на Apple Silicon: для совместимых архитектур MLX выбирается автоматически. Это сокращает число ручных настроек и добавляет embedding-сценарии в том же runtime.