DeepSeek V4 Flash, 에이전트 작업 속도서 GLM 5.2·Kimi K3 앞서
동일 성공률에 GLM 대비 2.5배·Kimi 대비 1.4배 빠름. 에이전트 백엔드 모델 선택 시 검토 가치.
요약
Composio에서 30개의 에이전트 작업(agentic tasks)을 통해 DeepSeek V4 Flash, Kimi K3, GLM 5.2의 성능을 비교 테스트했다. 동일한 Pi Agent 환경과 도구를 사용하여 공정하게 측정했을 때, DeepSeek V4 Flash는 유사한 성공률을 기록하면서도 타 모델 대비 빠른 속도를 보였다. 작업당 평균 소요 시간은 DeepSeek V4 Flash가 164초, Kimi K3가 226초, GLM 5.2가 419초로 나타났다. 결과적으로 DeepSeek V4 Flash는 GLM 5.2보다 2.5배, Kimi K3보다 1.4배 빠른 속도를 기록했다. 다만 DeepSeek V4 Flash는 작업당 토큰 사용량이 가장 많은 것으로 확인되었다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @composio: We tested DeepSeek V4 Flash against Kimi K3 and GLM 5.2 on 30 challenging agentic tasks. DeepSeek was 2.5x faster than GLM and 1.4
원문 보기 ↗