참고Reddit
오픈 웨이트 모델 'Ling-3.0-flash' 공개: 124B 파라미터 중 5.1B 활성
고효율 Sparse 모델로, 로컬 환경에서 긴 컨텍스트 추론 성능을 테스트해볼 만함.
요약
Ant Group의 inclusionAI가 지난 8월 4일 MIT 라이선스로 오픈 웨이트 모델 'Ling-3.0-flash'를 공개했다. 이 모델은 전체 파라미터 124B 규모이나 활성 파라미터는 5.1B에 불과한 효율적인 구조를 갖췄으며, 256K 컨텍스트 윈도우를 지원한다. 공개된 벤치마크 수치에 따르면 SWE-bench Pro 56.6점, AIME 2026 93.2점을 기록하며 높은 성능을 입증했다. 현재 SGLang과 vLLM 포크 버전으로만 이용 가능하며 GGUF 형식은 지원하지 않는다. 실무자들 사이에서는 가성비 높은 실행자형 모델로 주목받고 있으나, 장시간 세션에서의 도구 호출 안정성에 대한 검증이 필요한 상황이다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Ling-3.0-flash is open weight now - MIT, 124B total but only 5.1B active
원문 보기 ↗