참고X
Grok 4.7 업데이트, 벤치마크 성능 대폭 강화
CursorBench 및 EEBench 점수 향상. 코딩 및 에이전트 작업 성능 개선을 확인했으나 API 가격은 동일 유지.
요약
xAI의 새로운 AI 모델 Grok 4.7이 이전 버전인 4.6 대비 비약적인 성능 향상을 보였다. 오픈 월드 도시 게임 데모 테스트에서 Grok 4.7은 더 긴 작업 수행과 정교한 검증 능력을 통해 빌드 완성도를 높였다. 성능 지표인 CursorBench 점수는 기존 40.4%에서 46.3%로, EEBench 점수는 53%에서 64%로 각각 상승했다. 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러로 이전 버전과 동일하게 유지된다. 이번 업데이트는 동일한 비용 효율성을 유지하면서도 AI의 실질적인 코딩 및 문제 해결 능력을 대폭 강화했다는 점에서 주목된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @minchoi: Grok 4.7 just made 4.6 look old. Compare the open-world city game demos. 4.7 works longer, verifies more + builds better. CursorBe
원문 보기 ↗