참고X
알리바바, 고성능 이미지 생성 모델 'Qwen-Image-3.0' 공개
텍스트 렌더링 능력과 그리드 생성 등 시각적 정밀도가 향상됨. 이미지 생성 워크플로우에 테스트해볼 만한 오픈 웨이트 모델.
요약
알리바바가 최신 이미지 생성 모델인 Qwen-Image-3.0을 공식 출시했다. 이번 모델은 최대 4.5K 토큰의 프롬프트를 지원하며, 10px 크기의 작은 텍스트까지 선명하게 구현할 수 있는 높은 가독성을 갖췄다. 또한 12개 언어의 네이티브 렌더링을 지원하고 100개 이상의 시각적 스타일을 제공한다. 신문, 시험지, 복잡한 인터페이스를 한 번에 생성하거나 3×3 그리드에 9개의 상세 인포그래픽을 담는 등 복합적인 작업 수행 능력이 대폭 향상되었다. 아직 독립적인 벤치마크 결과는 발표되지 않았으나, 실사에 가까운 높은 품질의 결과물을 선보이며 업계의 주목을 받고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @LuminaXspace: 🚨 Alibaba just launched Qwen-Image-3.0 and it looks ridiculously capable The official improvements include: • Up to 4.5K-token pr
원문 보기 ↗