← promppy_ 실시간 AI 뉴스
참고Reddit

Ollama v0.33.3, Qwen3.6-35B Mac 환경 최적화 후기

MLX 지원으로 Mac Studio M1 Ultra 환경에서 초당 80 토큰 성능 달성 가능.

요약

Ollama 0.33.3 버전이 MLX를 공식 지원하게 되면서 Mac 환경에서의 추론 성능이 크게 향상되었다. Mac Studio M1 Ultra(64GB RAM) 환경에서 qwen3.6:35b 모델을 실행한 결과, 초당 약 80 토큰(tok/s)의 속도를 기록했다. 사용자들은 기존 MLX로의 전환을 고려하던 상황에서 Ollama 내장 MLX 지원을 통해 높은 만족감을 보이고 있다. 커뮤니티에서는 향후 qwen3.8 버전에서도 qwen3.6과 같은 Mixture of Experts(MoE) 모델이 Ollama에 도입되기를 기대하는 목소리가 높다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 new Ollama for qwen3.6:35b on Mac Studio m1 ultra 64G got ~80 tok/s

원문 보기 ↗

광고

다음 뉴스 →

중요Anthropic, DCF·LBO 등 월가 금융 워크플로우 자동화 에이전트 오픈소스 공개

Bloomberg·FactSet 연동 및 Excel 모델 자동화까지 포함. 금융 도메인 에이전트 구축 시 참고할 레퍼런스.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

최신 뉴스