참고X
Qwen3.8-Max-Preview 벤치마크 후기: '실성능 기대 이하' 논란
신모델 성능이 기존 주요 모델 대비 저조하다는 사용자 평가. Qwen 3.8 도입 검토 시 벤치마크 결과 비교에 참고.
요약
X(구 트위터)의 @OmedVibeCodes는 최근 벤치마크 테스트를 통해 Qwen3.8-Max-Preview의 성능을 검증한 결과를 공유했다. 해당 모델은 Fable 5 수준에 미치지 못할 뿐만 아니라, GPT-5.6이나 Opus 4.8 Max와 비교해도 성능 격차가 컸다. 작성자는 해당 모델이 홍보하는 수준의 성능을 전혀 보여주지 못했다고 평가하며 마케팅이 과장되었다고 지적했다. 테스트에 소요된 시간과 비용에 대한 불만을 표하며 Qwen 측에 환불을 요구하는 상황이다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @OmedVibeCodes: Just tested Qwen3.8-Max-Preview on my benchmark. It got absolutely cooked. Not Fable 5 level. Not even remotely close. It doesn't
원문 보기 ↗