샘 알트먼, Dreamforce서 차세대 모델 수학 능력 및 자율 에이전트 성과 언급
GPT-5.6 이후 모델의 수학적 추론 역량 강화와 1만 개 에이전트의 난제 해결 등 향후 모델 로드맵 시사.
요약
샘 올트먼은 최근 드림포스(Dreamforce) 행사에서 생성형 AI의 수학적 역량이 불과 4~6개월 만에 비약적으로 발전했다고 밝혔다. GPT-5.5는 평균적인 수학 교수 수준, GPT-5.6은 상위 1~2% 수준의 역량을 보였으며, 차세대 모델인 Astra는 이를 상회하는 성능을 기록했다. 특히 OpenAI의 내부 모델은 세계 최고의 수학자들도 해결하지 못한 7대 밀레니엄 난제 중 하나인 나비에-스토크스 방정식의 증명안을 제시하는 성과를 냈다. 이 과정에는 1만 개의 AI 에이전트가 투입되어 88시간 동안 수십억 개의 토큰을 처리하며 협업했다. 올트먼은 현재 내부 모델이 인간 수학자의 한계를 넘어서는 능력을 갖췄다고 평가했다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: Sam Altman at Dreamforce ranked how fast AI got smarter at math. GPT-5.5: as good as an average math professor. GPT-5.6: top 1-2%
원문 보기 ↗