알리바바, 차세대 이미지 생성 모델 'Qwen-Image-3.0' 공개
복잡한 레이아웃(신문, 인포그래픽 등) 생성과 10px 단위의 정밀한 텍스트 렌더링을 지원. 디자인 업무 생산성 도구로 검토할 가치가 있음.
요약
알리바바 클라우드(Alibaba Cloud)가 3세대 이미지 생성 모델인 Qwen-Image-3.0을 공개했다. 이번 모델의 핵심 가치는 'Real(실)'로, 최대 4.5k 토큰의 프롬프트를 지원하여 신문, 스토리보드, 인포그래픽 등 복잡한 레이아웃을 한 번에 생성할 수 있다. 10px 크기의 텍스트까지 읽을 수 있는 정밀한 묘사 능력과 LaTeX 문서 렌더링, 피부 질감 표현 등 높은 디테일을 구현했다. 또한 12개 언어 네이티브 렌더링과 100개 이상의 예술 스타일을 지원하며, 최신 웹 검색 결과를 반영하는 등 실무 활용성을 대폭 강화했다. 디자인, 교육, 이커머스 등 다양한 생산성 도구로서의 역할을 강조하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @Alibaba_Qwen: 🎨 Meet Qwen-Image-3.0 — the third generation of our foundational image generation model. If 1.0 was about "Precision," and 2.0 ad
원문 보기 ↗