Ollama, Apple MLX로 맥에서 로컬 AI 모델 속도 향상
Ollama taps Apple’s MLX framework to make local AI models faster on Macs

TL;DR AI
1분핵심 요약
Ollama가 MLX를 통합해 Apple Silicon에서 로컬 모델 추론 속도를 높였다.
업데이트는 NVFP4 지원과 캐싱·양자화 개선으로 지연을 줄였다.
이번 MLX 지원은 현재 Qwen3.5-35B-A3B 모델로 제한된다.



