Qwen3.8-Flash-Next·GLM-5.3-Flash 오픈웨이트 공개, 벤치마크서 Claude Opus 추월
MoE로 활성 파라미터는 6~18B지만 전체 가중치 저장 필요—로컬은 워크스테이션급 요구, MIT 라이선스 주목
요약
오픈 웨이트 및 로컬 AI 분야에서 고성능 신규 모델인 Qwen3.8-Flash-Next와 GLM-5.3-Flash가 공개되었다. Qwen3.8-Flash-Next는 125B MoE 구조(활성 파라미터 6B)로, SWE-bench Pro 등 9개 벤치마크 중 8개에서 Claude Opus 4.6 Max를 능가하는 성능을 보였다. 320B 규모의 GLM-5.3-Flash(활성 파라미터 18B)는 Terminal-Bench 2.1에서 84.3점을 기록하며 Opus 4.8에 근접한 성과를 냈다. 두 모델 모두 MIT 라이선스 기반이며 네이티브 멀티모달 지원 및 1M 컨텍스트 윈도우를 제공한다. 다만, 활성 파라미터와 무관하게 전체 가중치를 저장해야 하므로 일반 노트북이 아닌 고성능 워크스테이션이나 로컬 서버 환경이 필요하다. 이번 출시는 최신 SOTA급 성능의 모델을 로컬에서 운영할 수 있게 됨을 의미하며 오픈 AI에 대한 시장의 높은 수요를 증명한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @kimmonismus: Today is a huge day for open-weight and local AI. Qwen3.8-Flash-Next is a 125B MoE with another 51B n-gram embedding parameters, y
원문 보기 ↗