참고X
Perplexity, GPT-6 Astra 벤치마크 결과 공개... 성능·비용 효율 우위 확인
WANDR 벤치마크 결과, GPT-6 Astra가 Fable 5.1 대비 성능은 높고 비용은 낮아 실무 마이그레이션 근거로 참고 가능.
요약
Perplexity AI가 WANDR 벤치마크를 통해 최신 모델 GPT-6 Astra의 성능을 평가한 결과 0.682점을 기록하며 테스트한 모델 중 가장 높은 점수를 달성했다. 해당 모델의 작업당 비용은 11.98달러로 측정되었다. 이는 Fable 5.1과 비교했을 때 성능은 13.5% 높으면서 비용은 6.1% 저렴한 수준이다. 또한 Opus 5 대비 성능은 27.0% 높고 비용은 3.3% 더 높은 효율을 보였다. 이번 평가는 AI 모델의 실무적 성능과 비용 효율성을 가늠하는 중요한 지표를 제공한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @perplexity_ai: We evaluated GPT-6 Astra on WANDR. It scored 0.682 at $11.98 per task, the highest score of any model we tested. GPT-6-Astra score
원문 보기 ↗