Mistral(미스트랄) Large 4 프리뷰: 코딩 및 사이버 보안 능력 분석
Mistral(미스트랄) Large 4의 사이버 보안 지표와 훈련 인프라(4,000 Grace Blackwell) 정보 공유.
요약
Mistral AI가 유럽 자체 데이터센터에서 처음부터 학습시킨 멀티모달 모델 Mistral Large 4(일명 Le Chonk)를 공개했습니다. 이 모델은 1T 파라미터 규모로 49B의 활성 파라미터를 사용하며, NVIDIA Grace Blackwell Superchip 4,000개만을 활용해 학습되었습니다. 벤치마크 결과 DeepSWE v1.1에서 61.7%를 기록하며 GLM-5.3과 대등한 성능을 보였고, Artificial Analysis Cyber Index에서는 50점으로 GLM-5.3-Flash와 동급의 성적을 거뒀습니다. 특히 사이버 보안 평가인 CyberGym-E2E-AA에서는 82%를 기록해 MiMo-V2.6-Pro의 79%를 앞섰습니다. Mistral AI는 이번 모델을 통해 상대적으로 적은 컴퓨팅 자원으로도 최상위권 모델들과 경쟁할 수 있음을 증명했습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @kimmonismus: This is a surprising great release. Le Chaton fat is real! Mistral Large 4 puts Europe back in contention on coding and cybersecur
원문 보기 ↗