입력
참고:
start_image 또는 end_image 중 하나 이상이 제공되면 노드는 시작 프레임과 끝 프레임이 채워지고 나머지 프레임은 중성 회색 자리 표시자(0.5)를 사용하는 결합된 프레임 시퀀스를 구성합니다. 마스크는 채워진 영역을 알려진 영역으로, 자리 표시자 영역을 알려지지 않은 영역으로 표시하여 비디오 모델이 중간 프레임을 생성할 수 있게 합니다. 시작 이미지가 제공되면 알려진 영역은 이미지 너머로 3개의 추가 프레임까지 확장됩니다. 동일한 인코딩된 프레임 이미지와 마스크가 positive 및 negative 컨디셔닝에 모두 첨부됩니다. 두 CLIP 비전 입력이 모두 제공되면 해당 은닉 상태가 결합되고, 하나만 제공되면 단독으로 사용됩니다. 잠재 비디오 길이는 시간적 압축 후 length에서 파생됩니다: ((length - 1) // 4) + 1.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
0072e441cb80334c3c961d1bbf2d081c78bc38ed1eacca840c577a2d01b36f05