언어 바꾸기English
이전 목록

Ollama, Apple MLX로 맥에서 로컬 AI 모델 속도 향상

Ollama taps Apple’s MLX framework to make local AI models faster on Macs

TL;DR AI

핵심 요약

1분
  1. Ollama가 MLX를 통합해 Apple Silicon에서 로컬 모델 추론 속도를 높였다.

  2. 업데이트는 NVFP4 지원과 캐싱·양자화 개선으로 지연을 줄였다.

  3. 이번 MLX 지원은 현재 Qwen3.5-35B-A3B 모델로 제한된다.

원문 보기