← promppy_ 실시간 AI 뉴스
중요X

DeepSeek-V4.1-Flash (Max), 태스크당 $0.07로 비용 효율 파레토 최전선 재편

상위 모델 대비 37~76배 저렴한데 성능 35~54% 유지, 에이전트 비용 최적화 검토 대상.

요약

DeepSeek-V4.1-Flash (Max)가 비용 대비 성능 측면에서 뛰어난 효율성을 보이며 Agent Arena 평가에서 새로운 기준을 제시했다. 이 모델은 중앙값 작업당 0.07달러의 비용으로 4.87%의 순 개선 효과를 달성하여 최상위 오픈 모델 중 가장 낮은 비용을 기록했다. 특히 Hy4 preview 대비 비용을 73% 낮추면서도 성능의 98%를 유지했고, Kimi K3 (Max)와 비교해서는 비용을 92% 절감하며 76%의 성능을 확보했다. 최상위권 모델들과 비교 시 성능 개선 폭의 35~54%를 유지하면서도 비용은 97~99%까지 낮춰 37~76배의 비용 효율성을 달성했다. 이번 출시로 인해 GPT-5.6 Luna (xHigh), GLM-5.3-Flash, DeepSeek-V4-Flash는 Agent Arena의 파레토 프런티어에서 제외되었다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @arena: DeepSeek-V4.1-Flash (Max) is a breakthrough in performance to cost efficiency. With +4.87% net improvement at $0.07 cost per media

원문 보기 ↗

광고

다음 뉴스 →

중요젠슨 황, 올인 서밋 무대서 트럼프와 통화 공개…'AI 감속은 없다'

엔비디아·백악관 밀착 재확인. 미국 AI 규제 완화 기조는 국내 반도체·수출 정책에도 영향.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스