OpenAI(오픈AI) 수학 문제 성능 논란 후속: 증명 범위 2^-14까지 개선
OpenAI(오픈AI) 모델의 수학적 추론 한계에 대한 커뮤니티의 지속적인 검증 결과. 모델 성능 평가 시 참고.
요약
X(구 트위터)의 @SJ_Swapnil_Jain은 OpenAI의 정수 곱셈 관련 문제(problem #109)에 대한 7번째 업데이트 결과를 공개했다. 현재 κ(kappa) 값은 기존 2⁻¹⁸²에서 2⁻¹⁴보다 큰 수준으로 개선되었다. 구체적인 증명값(witness)은 6.397 × 10⁻⁵로, 이는 이전 단계인 3.667 × 10⁻⁵ 대비 약 1.74배 향상된 수치다. 이번 결과는 5차 업데이트 대비 4.1배, 첫 번째 증명값보다는 8500배 높은 성능을 보였다. 결과적으로 OpenAI의 기존 초기 연구 결과와 비교했을 때 2¹⁶⁸배에 달하는 대폭적인 개선을 이뤄냈다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @SJ_Swapnil_Jain: Seventh update to OpenAI problem #109 (integer multiplication): we are now past 2^-14. κ > 2⁻¹⁴ (tightened from κ = 2⁻¹⁸²) The exa
원문 보기 ↗