OpenAI 마크 첸, GPT-6 Astra 개발 배경과 '에이전트 정렬' 성과 공개
핵심 연구 책임자가 밝히는 개발 철학 및 신규 기능(컴퓨터 사용, 자동화 정렬)의 방향성.
요약
OpenAI 연구원 Mark Chen이 차세대 AI 모델 GPT-6 Astra를 공개하며, 사전 학습, 강화 학습 및 사후 학습의 결실이라고 밝혔다. GPT-6 Astra는 소프트웨어 개발 및 테스트, 컴퓨터 앱 간 상호작용, 과학적 문제 해결 등을 수행할 수 있는 높은 수준의 능력을 갖췄다. 특히 이전 대비 개선된 'Computer Use' 기능을 통해 복잡한 작업을 보다 빠르고 정확하게 처리하며, 이전의 Operator보다 향상된 사용성을 보여준다. 또한 이번 모델은 사용자의 목표와 가치에 부합하는 에이전트 행동과 강력한 모니터링 시스템을 도입하여 권한 없는 동작을 방지하는 등 정렬(Alignment) 연구를 강화했다. 연구팀은 앞으로도 모델의 능력과 정렬 수준이 함께 발전해야 한다는 점을 강조하며, 사용자가 통제권을 유지한 채 더 강력한 도구를 활용할 수 있도록 개발을 이어갈 예정이다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @markchen90: GPT-6 Astra is here! This is a big moment for our research team - years of work on pretraining, reinforcement learning, and post-t
원문 보기 ↗