Sakana, 대형 모델 없이 앙상블 라우팅으로 성능 극대화한 'Fugu Ultra v2' 출시
단일 플래그십 모델 대신 소형 모델 조합의 라우팅 아키텍처가 가성비와 성능 모두 우위임을 시사.
요약
Sakana AI가 공개한 Fugu Ultra v2 모델이 고난도 추론 작업에서 Opus 5를 뛰어넘는 성능을 기록했다. 이 모델은 대형 프런티어 모델을 단순히 사용하는 대신, 각 작업에 적합한 모델을 선택하는 스마트 라우터 기술을 적용했다. 실제로 Fugu Ultra v2는 Chartography 벤치마크에서 48.3점을 기록해 27.3점에 그친 Opus 5를 압도했으며, DeepSWE에서도 74.3점으로 경쟁 모델 대비 3~5배 낮은 비용으로 더 높은 성능을 보였다. 또한, 총 8개의 주요 하드 벤치마크 중 5개 부문에서 1위를 차지하는 성과를 거뒀다. 보급형 모델인 Fugu Max는 백만 토큰당 2달러에서 6달러 수준의 비용으로 Sonnet이나 GPT-5.6 대비 40~60% 저렴하면서도 가성비 면에서 우위를 점하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: Sakana shipped a model that beats Opus 5 on hard reasoning problems. Here's the kicker: it doesn't use Fable 5 or GPT-6-Astra. 🤯
원문 보기 ↗