Modeller

Lokale KI på Mac: Ollama bruker MLX som standard

10. oktober 2026 · 1 min lesing

a close-up of a circuit board
Anne Nygård / Unsplash

Ollama 0.40.0 kjører nå modeller på Apple-Silicon-Macs som standard via MLX, forutsatt at MLX støtter deres arkitektur. Oppdateringen utvider også MLX-støtten til flere språkmodeller, beslutningsmodeller og et embedding-modell.

Ollama er en åpen kildekode-programvare som lar brukere laste ned, administrere og kjøre KI-modeller på sin egen datamaskin. Via kommandolinjen kan man jobbe direkte med modellene; gjennom en lokal API-server kan de integreres i applikasjoner.

MLX blir standard for støttede modeller. Den automatiske overgangen gjelder ikke alle modeller, men kun arkitekturer som støttes av Ollamas MLX-kjøretid. MLX er Apples åpne rammeverk for maskinlæring på Apple-Silicon-brikker. I de korte utgivelsesnotatene til Ollama 0.40.0 beskriver prosjektet det nye standardvalget.

Blant de tilleggsoppførte modellene finnes Gemma 4, Qwen 3.6 og Qwen 3.5. For å laste ned og starte en modell brukes fortsatt de vanlige kommandoene ollama pull og ollama run. Utgivelsesnotatene viser dette med eksempelet Qwen 3.8.

Nå kjører også beslutningsmodellene Nimble, Tev1, Clef og Clef Flash over MLX. Ulikt en chatmodell gir slike modeller ingen fritekstsvar, men gir for eksempel valgbeslutninger eller vurderinger. Et bruksområde er kategorisering av innkommende billetter. Med EmbeddingGemma 2 støtter MLX-kjøretiden også et embedding-modell.