참고X
MiMo-V2.6 강화학습 결과, DeepSWE 벤치마크 72.57점 기록
최신 모델의 벤치마크 점수 업데이트입니다. 코딩 성능 평가 시 최신 랭킹 데이터로 활용하십시오.
요약
MiMo 강화학습(RL) 실행이 완료되면서 성능 지표에 유의미한 변화가 확인되었습니다. MiMo Pro 모델은 DeepSWE 벤치마크 점수가 기존 58.41점에서 72.57점으로 대폭 상승했습니다. 현재 DeepSWE의 최고 기록은 Astra, Gemini 3.8 Flash, Opus 5 모델이 달성한 74점입니다. 이번 MiMo Pro의 성능 향상은 기존 최고 모델들과 격차를 크게 좁히며 경쟁력 있는 수준에 도달했음을 보여줍니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @nrehiew_: Looks like the MiMo RL runs have completed. The pro model went from 58.41 to 72.57 on DeepSWE. For context, the highest score on D
원문 보기 ↗