Google이 공개한 동영상 생성·편집용 AI 모델. 텍스트, 이미지, 영상, 음성 등 여러 유형의 정보를 함께 이해하고 다루는 멀티모달 기능을 갖췄으며, 장면 확장, 프레임 고정, 4K 업스케일링을 지원한다.