Grok 4.7 실사용 평가: 벤치마크와 괴리된 실무 효율성 비판
실제 엔지니어링 작업 시 비용 대비 효율성 저하 및 반복 루프 현상 등 실무적 한계 지적.
요약
X 사용자 @theo는 최근 출시된 Grok 4.7 모델에 대해 가격 대비 성능과 효율성 측면에서 실망스럽다는 평가를 내놓았다. Grok 4.7은 당초 효율적일 것이라는 예고와 달리 이전 버전인 Grok 4.6보다 토큰 효율이 30~80% 낮고 실사용 비용은 2배 이상 증가했다. 또한 벤치마크 점수가 Grok 4.6보다 낮게 측정되며 속도와 사용자 경험 면에서도 퇴보했다는 지적을 받고 있다. 특히 3D 기능 부재와 프론트엔드 역량 부족, 특정 루프에 빠지는 현상 등 실질적인 기술적 결함이 두드러진다. 사용자는 SpaceXAI 팀이 이러한 문제점을 인정하고 다음 버전에서 개선된 성능을 보여주기를 기대하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @theo: Grok 4.5 was an incredible model for the price: fast, pleasant to use, reliable, solid default model. Grok 4.6 was a (forgivable)
원문 보기 ↗