참고X
Claude Fable 5.1, ARC-AGI 벤치마크 결과 공개… 전작 대비 비용 32% 절감
ARC-AGI 벤치마크에서 높은 점수를 기록했으며, 토큰 효율 개선을 통해 추론 비용을 유의미하게 낮췄습니다.
요약
Anthropic의 Fable 5.1 모델이 ARC-AGI 벤치마크 검증 결과에서 ARC-AGI-2 기준 90.0%, ARC-AGI-1 기준 97.5%의 정확도를 기록했다. 해당 모델의 작업당 비용은 ARC-AGI-2가 3.12달러, ARC-AGI-1은 1.40달러로 측정되었다. Fable 5.1은 향상된 토큰 효율성을 바탕으로 이전 버전인 Fable 5 대비 작업당 평균 비용을 약 32% 절감했다. 이번 성과는 추론 효율성을 최적화하려는 Anthropic의 기술적 진전을 보여준다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @arcprize: Fable 5.1 from @AnthropicAI on ARC-AGI (Verified): - ARC-AGI-2: 90.0%, $3.12/task - ARC-AGI-1: 97.5%, $1.40/task Across the two be
원문 보기 ↗