알리바바, 7B 이미지 모델 'Qwen-Image-2.1' 오픈소스 공개…생성·편집 통합
RGBA 투명 레이어·다중 참조·정확한 텍스트 렌더링 지원. 오픈웨이트라 사내 이미지 파이프라인 자체 구축 검토 가치.
요약
알리바바(Alibaba)가 7B 파라미터 규모의 오픈 소스 이미지 모델 'Qwen-Image-2.1'을 공개했다. 이 모델은 이미지 생성과 편집을 모두 지원하며 허깅페이스(Hugging Face)에서 가중치를 자유롭게 다운로드할 수 있다. 특히 네이티브하게 투명 이미지(RGBA 레이어)를 생성하여 합성 작업의 효율성을 높였으며, 최대 10개의 참조 이미지를 활용해 스토리보드를 제작할 수 있다. 특정 영역을 지정해 시계 제거, 머리색 변경, 의상 교체 등 정밀한 부분 수정이 가능하며 다중 편집도 지원한다. 기존 모델들의 고질적 약점이었던 텍스트 렌더링 성능이 뛰어나 포스터나 인포그래픽 제작에도 최적화되어 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: Alibaba open-sourced an image model that beats most closed-source alternatives. At 7B parameters. Qwen-Image-2.1. One model for bo
원문 보기 ↗