참고팁Reddit
오픈소스 비디오 생성 모델, Sora급 품질 달성 사례 공유
2년 전 Sora가 보여주었던 고품질 비디오 생성 수준에 도달한 최신 오픈소스 모델과 프롬프트 구조 확인.
요약
최근 레딧(Reddit)의 r/StableDiffusion 커뮤니티에서 오픈AI의 Sora 공개 2년 만에 이와 유사한 성능을 내는 '로컬 소라(local Sora)'가 등장했다는 소식이 화제다. 과거 Sora가 처음 공개되었을 당시 혁신적인 영상 생성 퀄리티로 큰 충격을 주었으나, 오디오 미지원과 강력한 검열 정책이 한계로 지적된 바 있다. 이번에 공유된 '로컬 소라' 모델은 복잡한 도심 풍경과 인물 반사 등 세밀한 디테일을 포함한 프롬프트를 성공적으로 구현했다. 특히 일본 도쿄 교외의 기차 창밖 풍경과 내부 승객의 모습을 자연스럽게 생성해 내며 높은 기술적 완성도를 보여주었다. AI 실무자들은 개인 로컬 환경에서 구동 가능한 고성능 영상 생성 모델의 등장이 오픈 소스 비디오 생성 AI 분야의 발전을 가속화할 것으로 기대하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 It took two years, but we finally have a 'local Sora'
원문 보기 ↗