중요AI타임스
딥시크 'V4.1 플래시' 출시…100만 토큰 창에 KV 캐시 75% 절감
14일부터 V4 프로 API가 자동 라우팅. 장기 에이전트 메모리 병목 개선되니 비용·성능 재검토 필요.
요약
딥시크가 장기 실행 AI 에이전트의 메모리 병목 현상을 해결한 경량 모델 'DeepSeek-V4.1-Flash'를 10일(현지시간) 출시했다. 이 모델은 100만 토큰의 초대형 컨텍스트 창을 지원하면서도 핵심 메모리인 KV 캐시 사용량을 전작 대비 약 75% 축소했다. 딥시크는 오는 14일부터 기존 'DeepSeek-V4 Pro' API 요청을 이 신규 모델로 자동 라우팅할 계획이다. 이번 업데이트를 통해 경량화된 모델이 기존 플래그십 모델의 성능을 대체하거나 보완하며 AI 에이전트의 효율성을 높일 것으로 기대된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 '딥시크 V4.1 플래시' 출시..."100만 토큰 창에 KV 캐시 75% 축소"
원문 보기 ↗