Локальный ИИ на Mac: Ollama использует MLX как стандарт
10 октября 2026 г. · 1 мин чтения
Ollama 0.40.0 теперь по умолчанию запускает модели на Apple-Silicon-Macs через MLX, если MLX поддерживает их архитектуру. Это обновление также расширяет поддержку MLX на другие языковые модели, модели решений и одно embedding-модель.
Ollama является программным обеспечением с открытым исходным кодом, с помощью которого можно загружать, управлять и запускать ИИ-модели на собственном компьютере. С помощью командной строки можно непосредственно работать с моделями; через локальный API-сервер их можно интегрировать в приложения. Как это работает на практике, объясняется в статье «Запуск языковых моделей локально».
Автоматическая настройка не применяется ко всем моделям, а только к архитектурам, поддерживаемым временем выполнения MLX от Ollama. MLX является открытым фреймворком Apple для машинного обучения на чипах Apple-Silicon. В коротких примечаниях к выпуску Ollama 0.40.0 проект описывает новый стандартный выбор.
Среди моделей, упомянутых в примечаниях, находятся Gemma 4, Qwen 3.6 и Qwen 3.5. Для загрузки и запуска модели по-прежнему используются обычные команды ollama pull и ollama run.
Теперь через MLX также работают модели решений Nimble, Tev1, Clef и Clef Flash. В отличие от чат-моделей, такие модели не генерируют свободный текстовый ответ, а выдают, например, выбор решений или оценки. Один из примеров применения, это распределение входящих заявок по категориям.
С помощью EmbeddingGemma 2 MLX также поддерживает одно embedding-модель. Она преобразует содержимое в векторы, которые можно сравнивать, например, для поиска похожести. Остальные модели разработчики Ollama планируют сначала протестировать, а затем разблокировать для MLX.