중요X
구글, 영상 생성·편집 멀티모달 모델 'Gemini Omni 1.1 Flash' 공개
장면 확장 컨텍스트가 Veo 1초→10초로 확대, 4K 업스케일·프레임 제어 추가. 영상 워크플로우 재검토 가치.
요약
구글이 영상 생성 및 편집을 위한 새로운 멀티모달 모델 'Gemini Omni 1.1 Flash'를 공개했다. 이 모델은 기존 Veo의 창작 제어 기능에 4K 업스케일링, 첫 화면 및 마지막 화면 제어, 360p 초안 작성 등 새로운 기능을 추가했다. 가장 큰 변화는 장면 확장 기능의 향상으로, 원본 영상의 10초 분량을 기반으로 장면을 확장할 수 있게 되어 기존 Veo의 1초 대비 대폭 개선되었다. 이를 통해 영상 생성 시 더 높은 일관성과 정교한 제어가 가능해졌으며, 더욱 길고 응집력 있는 스토리텔링을 지원한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @GoogleAI: Meet Gemini Omni 1.1 Flash ⚡️ Our newest multimodal model for video generation and editing. It now features your favorite creative
원문 보기 ↗