DeepSeek V4-Flash API 출시: 자사 Pro 프리뷰 능가하는 성능에 파격 단가
입력 100만 토큰 $0.14, 캐시 시 $0.0028. Opus·GPT 대비 100배 저렴, 비용 민감 서비스 검토 가치.
요약
DeepSeek이 V4-Flash API를 공개하며 AI 모델 가격 경쟁을 한층 격화시키고 있다. V4-Flash는 2,840억 개의 전체 파라미터 중 쿼리당 130억 개만 활성화하는 구조로, 100만 토큰의 컨텍스트를 지원하며 Codex를 네이티브로 탑재했다. 가격은 100만 입력 토큰당 0.14달러, 출력 토큰당 0.28달러로 책정되었으며, 캐시 히트 시 가격은 0.0028달러까지 낮아진다. 이는 Claude 3 Opus나 GPT-4o 대비 약 100배 저렴한 수준이다. 특히 이번 모델은 에이전트 및 코딩 벤치마크에서 상위 버전인 V4-Pro-Preview를 능가하는 성능을 보여주었으며, 향후 정식 Pro 버전 출시도 앞두고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: DeepSeek just made the AI pricing war even more brutal. V4-Flash API is now live. Same architecture as the preview. But agent and
원문 보기 ↗