← promppy_ 실시간 AI 뉴스
중요X

Qwen3.8-Flash-Next·GLM-5.3-Flash 오픈웨이트 공개, 벤치마크서 Claude Opus 추월

MoE로 활성 파라미터는 6~18B지만 전체 가중치 저장 필요—로컬은 워크스테이션급 요구, MIT 라이선스 주목

요약

오픈 웨이트 및 로컬 AI 분야에서 고성능 신규 모델인 Qwen3.8-Flash-Next와 GLM-5.3-Flash가 공개되었다. Qwen3.8-Flash-Next는 125B MoE 구조(활성 파라미터 6B)로, SWE-bench Pro 등 9개 벤치마크 중 8개에서 Claude Opus 4.6 Max를 능가하는 성능을 보였다. 320B 규모의 GLM-5.3-Flash(활성 파라미터 18B)는 Terminal-Bench 2.1에서 84.3점을 기록하며 Opus 4.8에 근접한 성과를 냈다. 두 모델 모두 MIT 라이선스 기반이며 네이티브 멀티모달 지원 및 1M 컨텍스트 윈도우를 제공한다. 다만, 활성 파라미터와 무관하게 전체 가중치를 저장해야 하므로 일반 노트북이 아닌 고성능 워크스테이션이나 로컬 서버 환경이 필요하다. 이번 출시는 최신 SOTA급 성능의 모델을 로컬에서 운영할 수 있게 됨을 의미하며 오픈 AI에 대한 시장의 높은 수요를 증명한다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @kimmonismus: Today is a huge day for open-weight and local AI. Qwen3.8-Flash-Next is a 125B MoE with another 51B n-gram embedding parameters, y

원문 보기 ↗
다음 뉴스 →

중요미스터리 모델 'Ox Alpha' 정체는 Z.ai…최신 GLM 시리즈로 수요일 가중치 공개

코딩·장기 에이전트 작업용 오픈 가중치 추론 모델. 벤치마크 상위권, 자체 호스팅 대안으로 검토 가치.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스