참고Reddit
JSON 네이티브 이미지 생성 모델 'Fibo 1.5' 공개
구조화된 캡션 기반의 제어와 재현성을 강조한 오픈소스 모델로, 기존 이미지 생성 워크플로우에 대안이 될 수 있음.
요약
Bria AI가 공개한 Fibo 1.5는 기존 Fibo 모델을 DMD 및 DMD-R 방식으로 증류(distillation)하여 생성 효율을 극대화한 이미지 생성 모델이다. 이 모델은 분류기 없는 가이드(classifier-free guidance) 없이도 단 4~6회의 추론 단계만으로 이미지를 생성할 수 있다. Fibo 시리즈는 긴 구조화된 캡션을 기반으로 학습된 최초의 JSON 네이티브 이미지 생성 모델로, VGL(Visual GenAI Language) 패러다임을 통해 높은 제어력과 예측 가능성을 제공한다. 이번 1.5 버전은 기존의 JSON 네이티브 구조화 프롬프팅 및 제어 기능을 유지하면서도 사실적인 묘사와 텍스처 품질을 개선했다. 개발자들은 허깅페이스를 통해 Fibo 1.5 관련 자료를 확인할 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Fibo 1.5 - few-step distillation + improved realism
원문 보기 ↗