사용자가 텍스트 프롬프트와 비디오 프레임을 입력 받아 시퀀스를 생성하는 비디오 모델의 등장 시기를 문의했어요. 현재는 프레임 기반 모델이 주를 이루지만, 시퀀스 기반 모델 연구가 활발히 진행 중이에요. 사용자는 이러한 모델이 곧 등장할 것이라고 기대하고 있습니다. 현재 프레임 기반 모델이 주를 이루지만, 사용자가 제시한 방식의 시퀀스 기반 모델은 연구 단계에 있어요.