참고Reddit
영상 생성 모델 LTX-2.5 공개
멀티샷 생성 및 확산 충실도 렌더링 도입. 캐릭터 일관성과 복잡한 장면 묘사 성능 개선.
요약
Stability AI가 영상 생성 모델 LTX-2.5를 공개했다. 이번 업데이트는 기존 LTX 아키텍처의 전 단계를 재설계하고, 더 큰 데이터셋과 강화 학습 후학습(RLHF)을 적용한 것이 핵심이다. 가장 큰 특징은 단일 생성으로 캐릭터 정체성, 환경, 조명, 스타일을 유지하며 여러 컷이 연결된 영상을 만드는 'Native multishot' 기능이다. 또한 'Diffusion Fidelity Rendering' 기술을 도입해 장면의 복잡도에 따라 연산 자원을 동적으로 할당함으로써, 영상의 선명도를 높이고 복잡한 프롬프트에 대한 응답 성능을 개선했다. 이제 사용자는 한 번의 프롬프트 입력으로 보다 정교하게 연결된 다중 샷 영상을 생성할 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 LTX-2.5 is Here
원문 보기 ↗