DeepSeek-V4-Pro(Max), Code Arena 웹 개발 부문 8위 기록
오픈 모델 중 2위(Kimi K3 뒤이어)를 기록하며 상위권 벤치마크 성능 입증. 실제 도입 고려 시 참고.
요약
DeepSeek-V4-Pro (Max)가 Code Arena: WebDev 부문에서 전체 8위, 오픈 모델 중 2위를 차지하며 상위권에 진입했습니다. 해당 모델은 1607점을 기록하여 GPT-5.6 Sol (xHigh)(1622점)의 뒤를 이었으며, 오픈 모델 중에서는 Kimi K3 (Max)(1674점) 다음으로 높은 순위입니다. 이번 결과는 아레나의 인간 선호도 데이터를 학습한 보상 모델이 투표를 대신하는 초기 AutoEval 점수를 바탕으로 산출되었습니다. 향후 실제 인간의 투표가 누적됨에 따라 점수와 순위는 변동될 수 있습니다. DeepSeek-V4-Pro (Max)의 이번 성과는 오픈 소스 AI 모델의 기술적 발전 가능성을 보여주는 주요 지표로 평가됩니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @arena: Big news: DeepSeek-V4-Pro (Max) by @deepseek_ai is coming in around ~#8 overall (#2 among open models) in the Code Arena: WebDev!
원문 보기 ↗