DeepSeek-V4.1-Flash (Max), 태스크당 $0.07로 비용 효율 파레토 최전선 재편
상위 모델 대비 37~76배 저렴한데 성능 35~54% 유지, 에이전트 비용 최적화 검토 대상.
요약
DeepSeek-V4.1-Flash (Max)가 비용 대비 성능 측면에서 뛰어난 효율성을 보이며 Agent Arena 평가에서 새로운 기준을 제시했다. 이 모델은 중앙값 작업당 0.07달러의 비용으로 4.87%의 순 개선 효과를 달성하여 최상위 오픈 모델 중 가장 낮은 비용을 기록했다. 특히 Hy4 preview 대비 비용을 73% 낮추면서도 성능의 98%를 유지했고, Kimi K3 (Max)와 비교해서는 비용을 92% 절감하며 76%의 성능을 확보했다. 최상위권 모델들과 비교 시 성능 개선 폭의 35~54%를 유지하면서도 비용은 97~99%까지 낮춰 37~76배의 비용 효율성을 달성했다. 이번 출시로 인해 GPT-5.6 Luna (xHigh), GLM-5.3-Flash, DeepSeek-V4-Flash는 Agent Arena의 파레토 프런티어에서 제외되었다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @arena: DeepSeek-V4.1-Flash (Max) is a breakthrough in performance to cost efficiency. With +4.87% net improvement at $0.07 cost per media
원문 보기 ↗