← promppy_ 실시간 AI 뉴스
중요AI타임스

딥시크 'V4.1 플래시' 출시…100만 토큰 창에 KV 캐시 75% 절감

14일부터 V4 프로 API가 자동 라우팅. 장기 에이전트 메모리 병목 개선되니 비용·성능 재검토 필요.

요약

딥시크가 장기 실행 AI 에이전트의 메모리 병목 현상을 해결한 경량 모델 'DeepSeek-V4.1-Flash'를 10일(현지시간) 출시했다. 이 모델은 100만 토큰의 초대형 컨텍스트 창을 지원하면서도 핵심 메모리인 KV 캐시 사용량을 전작 대비 약 75% 축소했다. 딥시크는 오는 14일부터 기존 'DeepSeek-V4 Pro' API 요청을 이 신규 모델로 자동 라우팅할 계획이다. 이번 업데이트를 통해 경량화된 모델이 기존 플래그십 모델의 성능을 대체하거나 보완하며 AI 에이전트의 효율성을 높일 것으로 기대된다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 '딥시크 V4.1 플래시' 출시..."100만 토큰 창에 KV 캐시 75% 축소"

원문 보기 ↗

광고

다음 뉴스 →

중요LG AI연구원, 국민연금과 기금운용 특화 환율 예측 AI 공동 개발

EXAONE BI가 공공 연기금까지 확장. 금융·공공 AI 도입 검토 시 국내 레퍼런스로 주목.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

최신 뉴스