Claude Sonnet 5.5 출시: 지능지수 56점으로 Opus 5.5에 2점 차 근접
가격은 Sonnet 5와 동일하나 토큰 출력 증가로 작업당 비용 ~50% 상승. 에이전트 비용 재검토 필요.
요약
Anthropic이 새롭게 출시한 Claude Sonnet 5.5는 Artificial Analysis Intelligence Index에서 56점을 기록하며, Opus 5.5(max)에 이어 2위를 차지하는 높은 성능을 보였습니다. 특히 Terminal-Bench 4.0에서 64%의 점수를 달성하며 에이전트 작업 및 지식 업무 분야에서 Opus 5.5나 GPT-6 Astra보다 우수한 결과를 냈습니다. 다만, Opus 5.5 수준의 성능을 내기 위해 최대 약 193k의 Output Tokens를 사용하는 등 측정된 모델 중 가장 많은 토큰을 소모하는 특징이 있습니다. 가격은 기존 Sonnet 5와 동일한 입력 2달러, 출력 10달러(백만 토큰당)로 책정되었으나, 높은 토큰 사용량으로 인해 작업당 비용은 약 50% 증가했습니다. 과학적 추론이나 사실적 지식 평가에서는 여전히 Opus 5.5보다 낮은 점수를 보였으며, Anthropic은 초기 평가에서 발견된 구조화된 출력 관련 버그를 정식 출시 버전에서 수정했다고 밝혔습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ArtificialAnlys: Anthropic has launched Claude Sonnet 5.5: it scores 56 on the Artificial Analysis Intelligence Index, just 2 points behind Opus 5.
원문 보기 ↗