← promppy_ 실시간 AI 뉴스
참고X

Qwen3.8-Max-Preview 벤치마크 후기: '실성능 기대 이하' 논란

신모델 성능이 기존 주요 모델 대비 저조하다는 사용자 평가. Qwen 3.8 도입 검토 시 벤치마크 결과 비교에 참고.

요약

X(구 트위터)의 @OmedVibeCodes는 최근 벤치마크 테스트를 통해 Qwen3.8-Max-Preview의 성능을 검증한 결과를 공유했다. 해당 모델은 Fable 5 수준에 미치지 못할 뿐만 아니라, GPT-5.6이나 Opus 4.8 Max와 비교해도 성능 격차가 컸다. 작성자는 해당 모델이 홍보하는 수준의 성능을 전혀 보여주지 못했다고 평가하며 마케팅이 과장되었다고 지적했다. 테스트에 소요된 시간과 비용에 대한 불만을 표하며 Qwen 측에 환불을 요구하는 상황이다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @OmedVibeCodes: Just tested Qwen3.8-Max-Preview on my benchmark. It got absolutely cooked. Not Fable 5 level. Not even remotely close. It doesn't

원문 보기 ↗
다음 뉴스 →

중요SKT-KAIST, 영상 합성 90% 자동화 기술 '인서트애니웨어' ECCV 2026 채택

객체 가림·겹침 품질저하 해결한 3D/4D 합성 상용화 임박. 광고·영상 제작 워크플로 재편 주목.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스