참고팁X
Deepseek V4 Flash 모델에 비전 기능 입히는 '2-스텝' 해킹
저렴한 텍스트 전용 모델에 시각 기능을 결합해 비용을 1/20로 절감하는 실용적인 워크플로우.
요약
X 사용자 @cyrilXBT는 월 200달러의 Claude 구독을 해지하고 Deepseek V4 Flash로 전환하여 비용을 약 20분의 1로 절감했다. Deepseek V4 Flash는 텍스트 처리 능력은 뛰어나지만 이미지나 영상 처리 기능이 없는 '맹인' 모델이라는 제약이 있다. 이를 해결하기 위해 'claude-video'와 'modlens'라는 두 가지 도구를 설치하는 방식의 우회 솔루션이 공유되었다. 해당 조합을 사용하면 시각적 기능이 없는 텍스트 전용 모델에서도 에이전트가 영상이나 이미지를 인식할 수 있게 된다. 비용 효율적인 AI 운영을 고민하는 실무자들에게 유용한 활용 팁이 될 것으로 보인다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @cyrilXBT: Dropped the $200/month Claude subscription. Swapped Opus 5 for Deepseek V4 Flash at roughly 1/20th the cost. Only snag: it’s blind
원문 보기 ↗