DeepSeek, 멀티모달 모델 'DeepSeek-V4-Flash-Vision-Exp' API 공개
멀티모달 에이전트 성능이 Opus-4.8에 근접. 시각+툴 결합 워크플로우 검토 가치 있음.
요약
DeepSeek이 실험적 멀티모달 모델 'DeepSeek-V4-Flash-Vision-Exp'를 DeepSeek API 플랫폼에 공개했다. 이번 모델은 텍스트 추론, 에이전트 능력, 세계 지식 측면에서 기존 DeepSeek-V4-Flash와 동일한 성능을 갖췄다. 특히 멀티모달 에이전트 벤치마크에서 큰 향상을 이루며 Opus-4.8 수준의 성능을 확보했다. 사용자는 모델명 'deepseek-v4-flash-vision-exp'를 통해 API를 이용할 수 있다. 또한 DeepSeek Harness 0.1.1 버전이 배포되어 신규 모델을 즉시 지원한다. 이 모델은 시각적 이해와 다양한 도구를 결합하여 에이전트 프레임워크 전반에서 실무 워크플로우를 최적화하는 데 활용될 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @deepseek_ai: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches DeepSeek-V
원문 보기 ↗