오픈소스 AI 에이전트 'Frontis-MA1' 공개: 재귀적 자기 개선으로 ML 엔지니어링 수행
MLE-Bench에서 GPT-5.5 + Codex 능가. ML 엔지니어링 최적화 루프를 구축하고 싶은 개발자라면 오픈소스 스택 검토 가치 있음.
요약
재귀적 자기 개선 능력을 갖춘 AI 에이전트 'Frontis-MA1(35B)'가 공개되었다. 이 모델은 기계 학습 엔지니어링 환경에서 Draft, Improve, Debug, Crossover의 4가지 연산자를 통해 학습과 진화를 하나의 루프로 통합한다. 실시간 실행 피드백을 활용하는 이 모델은 MLE-Bench Lite 평가에서 기본 39.4%에서 Evo-Max 적용 시 71.2%까지 성능이 향상되는 결과를 보였다. 이는 GPT-5.5와 Codex를 상회하는 수치이며, NatureBench와 같은 외부 벤치마크에서도 성능 향상이 확인되었다. 현재 Frontis-MA1의 모델 가중치와 코드는 모두 오픈 소스로 제공된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @mark_k: Recursive Self Improvement is here! Frontis-MA1 (35B) is a new AI4AI agent trained for recursive self-improvement in machine learn
원문 보기 ↗