Claude Fable 5.1 상세 벤치마크 공개: 캐시 효율 및 에이전트 성능 분석
캐시 읽기 비용 75% 절감 및 주요 에이전트 벤치마크 성능 향상 수치 확인. 비용 최적화 전략 수립에 참고.
요약
Anthropic의 Claude Fable 5.1은 이전 버전인 Claude Fable 5 대비 비용 효율성과 에이전트 성능이 크게 향상되었습니다. 토큰당 가격은 기존과 동일하지만 캐시 읽기 비용이 75% 인하되어 일반적인 작업에서는 약 25%, 에이전트 중심 작업에서는 최대 45%의 비용 절감 효과가 예상됩니다. 성능 면에서는 Scientific agent benchmark에서 52.6%를 기록하며 기존 24.7% 대비 두 배 이상 향상되었고, AutomationBench에서도 84%의 상대적 성능 향상을 보였습니다. 또한, Claude Code 세션 내 사이버 보안 개입이 약 60% 감소하고 생물학 관련 안전 가이드라인 오류가 85% 줄어드는 등 불필요한 차단 조치가 대폭 개선되었습니다. 실무 테스트 결과, 이전 모델 대비 토큰 사용량은 줄면서 응답 속도는 약 두 배 빨라지는 등 간결성과 효율성이 강화되었습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @kimmonismus: Claude Fable 5.1 is cheaper, substantially stronger on several agentic benchmarks, more concise, and apparently far less trigger-h
원문 보기 ↗