← promppy_ 실시간 AI 뉴스
참고X

MiMo-V2.6 강화학습 결과, DeepSWE 벤치마크 72.57점 기록

최신 모델의 벤치마크 점수 업데이트입니다. 코딩 성능 평가 시 최신 랭킹 데이터로 활용하십시오.

요약

MiMo 강화학습(RL) 실행이 완료되면서 성능 지표에 유의미한 변화가 확인되었습니다. MiMo Pro 모델은 DeepSWE 벤치마크 점수가 기존 58.41점에서 72.57점으로 대폭 상승했습니다. 현재 DeepSWE의 최고 기록은 Astra, Gemini 3.8 Flash, Opus 5 모델이 달성한 74점입니다. 이번 MiMo Pro의 성능 향상은 기존 최고 모델들과 격차를 크게 좁히며 경쟁력 있는 수준에 도달했음을 보여줍니다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @nrehiew_: Looks like the MiMo RL runs have completed. The pro model went from 58.41 to 72.57 on DeepSWE. For context, the highest score on D

원문 보기 ↗

광고

다음 뉴스 →

중요미국 정부, "AI 속도 우려 기업은 스스로 멈춰라"… 강제 규제엔 선 긋기

미 규제 개입 최소화 기조 재확인. AI 안전·거버넌스는 당분간 기업 자율에 맡겨질 전망.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스