참고팁Reddit
Ollama v0.33.3, Qwen3.6-35B Mac 환경 최적화 후기
MLX 지원으로 Mac Studio M1 Ultra 환경에서 초당 80 토큰 성능 달성 가능.
요약
Ollama 0.33.3 버전이 MLX를 공식 지원하게 되면서 Mac 환경에서의 추론 성능이 크게 향상되었다. Mac Studio M1 Ultra(64GB RAM) 환경에서 qwen3.6:35b 모델을 실행한 결과, 초당 약 80 토큰(tok/s)의 속도를 기록했다. 사용자들은 기존 MLX로의 전환을 고려하던 상황에서 Ollama 내장 MLX 지원을 통해 높은 만족감을 보이고 있다. 커뮤니티에서는 향후 qwen3.8 버전에서도 qwen3.6과 같은 Mixture of Experts(MoE) 모델이 Ollama에 도입되기를 기대하는 목소리가 높다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 new Ollama for qwen3.6:35b on Mac Studio m1 ultra 64G got ~80 tok/s
원문 보기 ↗