Artificial Analysis: GPT-6 Astra, 코딩 에이전트 지표서 Fable 5와 대등한 성능
코딩 효율은 70% 개선되었으나 가격이 2.5배 상승함. 서비스 비용 구조 재산정 필요.
요약
Artificial Analysis가 발표한 새로운 벤치마크 결과, GPT-6 Astra는 Coding Agent Index에서 67점을 기록하며 Claude Opus 5 및 Fable 5와 대등한 성능을 보였습니다. 특히 GPT-5.6 Sol 대비 토큰 효율성이 70% 향상되어 동일 점수 기준 Fable 5보다 절반 이하의 비용으로 작업을 처리할 수 있습니다. 반면 Intelligence Index에서는 61점으로 GPT-5.6 Sol과 동등한 수준이나, 새로운 가격 정책으로 인해 이전 모델 대비 작업당 비용이 75% 상승했습니다. 가격은 백만 토큰당 입력 10달러, 출력 50달러로 GPT-5.6 Sol보다 2.5배 인상되었습니다. 또한 GPT-6 Astra는 AA-Omniscience 지식 및 환각 벤치마크에서 GPT-5.6 Sol 대비 환각 발생률을 절반 수준으로 크게 낮췄습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ArtificialAnlys: GPT-6 Astra makes significant gains in the Artificial Analysis Coding Agent Index, scoring equal to Fable 5 at lower cost. In the
원문 보기 ↗