분석: Claude의 추론 토큰 예산이 최근 급감했다는 의혹
Claude Code의 추론 토큰 사용량이 최근 18-50% 감소했다는 분석이 제기되었습니다. 복잡한 작업 수행 시 성능 저하를 겪고 있다면 참고하세요.
요약
최근 43,000건 이상의 Claude Code 호출을 65일간 분석한 결과, Anthropic이 Claude의 추론 예산(thinking budget)을 사용자 몰래 축소하고 있다는 의혹이 제기되었습니다. 분석에 따르면 전체 호출의 39%가 추론 토큰을 전혀 할당받지 못했으며, 중앙값은 123토큰에 불과해 벤치마크에 사용된 16K~128K 수준에 크게 미치지 못했습니다. 특히 8월에는 7월 대비 추론 예산이 18~50% 감소했으며, 8월 22일경에는 중앙값이 0에 도달하기도 했습니다. 벤치마크상으로는 128K 토큰까지 성능이 향상되지만, 실제로는 제한된 자원만 제공되고 있어 모델 성능이 저하되는 현상이 나타나고 있습니다. Anthropic이 '전체 모델 접근 권한'을 판매한다고 광고하면서 실제 추론 환경은 조용히 조정하고 있다는 비판이 커지고 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 It's time to cancel your subscriptions - Anthropic is silently nerfing Claude's reasoning budget while telling you it's the same model
원문 보기 ↗