OpenAI(오픈AI), 수학 문제 해결 성능 두고 학계와 갈등… 권고안 미준수 논란
OpenAI(오픈AI)의 모델이 수학 문제 해결을 위해 제시한 방법론이 전문가 그룹의 기준을 충족하지 못했다는 지적. 모델의 논리적 검증 역량에 대한 의문 제기.
요약
OpenAI가 고난도 수학 문제들에 대한 해결책을 대거 공개했으나, 전문가 그룹의 표준을 충족하지 못했다는 지적이 제기되었습니다. OpenAI는 논란을 피하고자 수학자 자문 그룹의 권고를 참고했다고 밝혔으나, 수학계가 중요시하는 결과에 대한 인간의 이해와 논리적 증명 과정에서 한계를 보였습니다. 특히 프린스턴 고등연구소 산하 '수학 및 AI 자문 그룹(AGMAI)'은 비공개 모델을 이용한 고등 수학 문제 테스트 중단을 권고했음에도, OpenAI는 여전히 독자적인 모델 평가를 고집하고 있습니다. 최근 연구 논문에서도 OpenAI 모델이 해결한 문제들이 자연어와 공식적 증명 사이의 간극이 크다는 점이 지적되었습니다. 이번 사태는 AI 모델이 수학적 난제를 해결하는 과정에서 학계의 엄격한 검증 기준을 따르는 데 어려움을 겪고 있음을 보여줍니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 OpenAI’s math solutions aren’t meeting the field’s standards yet
원문 보기 ↗