참고X
GPT-6 Astra vs. Fable 5.1 수학 벤치마크 비교: 비용 효율성 3배 격차
연구급 수학 문제 해결 시 GPT-6 Astra가 Fable 5.1 대비 약 3배 저렴한 비용으로 유사한 성능을 보인다는 벤치마크 결과.
요약
최근 공개된 벤치마크 테스트에서 GPT-6 Astra가 Fable 5.1을 근소하게 앞서는 성능을 기록했다. arXiv에 게재된 연구 수준의 수학 문제를 대상으로 한 평가에서 GPT-6 Astra는 88.6%, Fable 5.1은 87.7%의 정확도를 보였다. 특히 비용 효율성 측면에서 GPT-6 Astra의 강점이 두드러졌다. GPT-6 Astra의 문제당 비용은 3.63달러로, 12.77달러가 소요되는 Fable 5.1 대비 3분의 1 미만의 비용으로 유사한 성능을 달성했다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @haider1: GPT-6 Astra brutally mogged Fable 5.1 on a benchmark testing research-level math problems from recent arXiv papers 88.6% vs. 87.7%
원문 보기 ↗