← promppy_ 실시간 AI 뉴스
참고Hacker News

Qwen3.8 Max, 에이전트 벤치마크 1위 등극

에이전트 성능 평가에서 Qwen 신규 모델이 최상위권 달성. 모델 선정 시 벤치마크 지표 변화 확인 필요.

요약

Artificial Analysis가 발표한 Intelligence Index v4.1.1에서 Qwen3.8 Max가 종합 성능 1위 모델로 등극했다. 이번 업데이트에서는 𝜏³-Banking v1.0.1이 적용되었으며, HLE, AA-LCR, AA-Omniscience 평가 모델이 GPT-5.6 Luna(medium)로 업그레이드되었다. Intelligence Index v4.1.1은 GDPval-AA v2, Terminal-Bench v2.1, SciCode, Humanity's Last Exam 등 다양한 벤치마크를 포함하여 AI 모델의 지능을 객관적으로 측정한다. 이번 벤치마크 데이터는 모델별 지능, 속도, 비용 등 주요 지표를 기반으로 하여 실무자가 적합한 모델과 제공자를 선택하는 데 도움을 준다. 또한 사용자는 플랫폼 지원 및 에이전트 기능을 비교하여 업무 목적에 맞는 최적의 모델을 탐색할 수 있다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 Qwen3.8 Max now ranked as the best overall model by agentic index

원문 보기 ↗
다음 뉴스 →

중요Cursor, 스킬·MCP 서버를 묶는 오픈 표준 'Agent Plugins' 지원

에이전트마다 따로 설정하던 스킬·MCP를 하나로 번들링해 재사용 가능. 표준 채택 여부 주목.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

다른 매체 보도

관련 뉴스

최신 뉴스