← promppy_ 실시간 AI 뉴스
중요X

Qwen, 오픈웨이트 멀티모달 MoE 'Qwen3.8-Flash' 공개…Qwen4 아키텍처 미리보기

토큰당 6B만 활성, 입력 100만당 $0.16. Qwen3.7 대비 코딩·오피스 강세라 비용절감 검토 가치.

요약

알리바바가 멀티모달 MoE 모델인 Qwen3.8-Flash를 오픈 웨이트로 공개했으며, 이는 차세대 Qwen4 아키텍처의 초기 버전이다. 해당 모델은 125B 파라미터와 51B N-gram 임베딩으로 구성되어 있으며, 토큰당 6B만 활성화되어 높은 비용 효율성을 제공한다. 성능 면에서 DeepSWE 1.1 58.7점, SWE-bench Pro 62.5점 등을 기록하며 이전 모델인 Qwen3.7-Plus 대비 9분의 1 수준의 학습 비용으로 더 뛰어난 코딩 및 오피스 업무 능력을 보여준다. 아키텍처 측면에서는 GDN 및 QSA 하이브리드 어텐션, Gated Residual, Muon 옵티마이저를 도입했다. 기본 컨텍스트 윈도우는 262K를 지원하며, YaRN을 통해 최대 1M까지 확장이 가능하다. 곧 QwenCloud API를 통해 입력 토큰 100만 개당 0.16달러, 출력 토큰 100만 개당 0.47달러의 가격으로 정식 출시될 예정이다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @Alibaba_Qwen: ⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weight! The production version Qwen

원문 보기 ↗
다음 뉴스 →

중요중국 오픈소스 공세: 'Ox Alpha'·Qwen3.8-Flash-Next 오픈웨이트 동시 공개 예고

Qwen 신규 MoE(125B-A6B) 아키텍처 주목. 상업용 오픈웨이트 대안 검토 여지.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

다른 매체 보도

관련 뉴스

최신 뉴스