DeepSeek-V4.1-Flash, 오픈 모델 3위 등극…작업당 $0.07로 압도적 가성비
1위 대비 성능 1.5%p 차이에 비용은 91% 저렴. 에이전트 워크로드 비용 최적화 시 검토 대상.
요약
DeepSeek의 새로운 모델인 DeepSeek-V4.1-Flash (Max)가 Agent Arena 내 오픈 모델 순위에서 3위를 차지하며 강력한 성능을 입증했습니다. 해당 모델은 이전 대비 4.87%의 순 개선율을 기록했으며, 과제당 중간 비용은 0.07달러로 상위 3개 오픈 모델 중 가장 저렴한 비용 효율성을 보입니다. 1위인 Kimi K3 (Max)와는 성능 격차가 1.52%포인트에 불과하지만 비용은 91% 낮고, 2위인 Hy4 preview와 비교해서는 0.09%포인트 차이로 성능을 추격하며 비용은 68% 저렴합니다. 전반적인 순위에서는 12위를 기록했으나, 확인된 성공률(Confirmed Success) 지표에서는 13.75%를 기록하며 4위에 올랐습니다. 이번 출시는 성능과 비용 효율성을 모두 갖춘 모델로서 AI 에이전트 시장에서 파레토 최적을 재정의했다는 평가를 받습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @arena: Exciting news: DeepSeek-V4.1-Flash (Max) by @deepseek_ai just landed in Agent Arena at #3 among open models! With +4.87% net impro
원문 보기 ↗