Black Forest Labs, 이미지·비디오·오디오 통합 'FLUX 3' 공개
현재는 게이트형 얼리 액세스. Dev 오픈 웨이트 출시 여부가 실사용 관건이며 성능 수치는 내부 자료로 검증 필요
요약
독일 프라이부르크 기반의 AI 기업 Black Forest Labs가 이미지, 비디오, 오디오, 행동 예측을 통합한 멀티모달 모델 FLUX 3를 발표했다. 현재 FLUX 3는 일반 오픈 소스가 아닌 게이트 형태의 얼리 액세스로 제공되고 있으며, 향후 FLUX 3 Dev 버전의 오픈 웨이트 공개 여부가 주목받고 있다. Black Forest Labs는 내부 비교 평가를 통해 FLUX 3가 Runway Gen-4.5, Luma Ray 3.2, Kling 3 Pro, Seedance 2.0 등 경쟁 모델을 능가하는 성능을 보였다고 주장했다. 다만 해당 수치는 초기 얼리 액세스 단계의 결과로 독립적인 검증은 이루어지지 않았다. 이번 발표는 최근 공개된 중국 Minimax H3 모델과 함께 생성형 비디오 AI 시장의 빠른 기술 발전 속도를 보여주는 사례로 평가된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @kimmonismus: Black Forest Labs just announced FLUX 3: a unified multimodal model for image, video, audio and action prediction. Founded in Frei
원문 보기 ↗