Claude Code 사용 시 'Fable' 모델의 높은 토큰 소모 주의
Opus 대비 Fable 모델 사용 시 쿼터 소모 속도가 지나치게 빠르다는 사용자 경험. 비용 최적화 시 참고.
요약
Reddit의 ClaudeCode 서브레딧에서 Anthropic의 모델인 Fable과 Opus 간의 사용량 격차가 크게 발생한다는 사용자 경험이 공유되었다. 게시글 작성자는 Fable 모델이 100k 미만의 작은 컨텍스트에서도 코드 탐색, 작성, 리뷰 등의 작업을 수행할 때 할당량을 수 분 내에 소진한다고 지적했다. 반면, 동일한 작업 환경에서 Opus 모델을 사용할 경우 600k의 더 큰 컨텍스트와 이미지 처리까지 포함하더라도 할당량 소모가 거의 발생하지 않는 것으로 나타났다. 작성자는 두 모델 간의 할당량 소모 차이가 이론상의 2배를 넘어 체감상 100배에 달할 정도로 격차가 크다고 주장했다. 실무자들은 ClaudeCode 활용 시 Fable의 높은 리소스 점유율로 인한 비용 효율성을 고려할 필요가 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Fable supposedly uses roughly 2x as much usage as Opus, but my recent experience feels more like 100x. The difference is night and day.
원문 보기 ↗