입력
참고:
start_image가 제공되면 이중 선형 보간(bilinear interpolation)을 사용하여 지정된 width 및 height에 맞게 자동으로 크기가 조정됩니다. 이미지 배치의 처음 length 프레임이 사용되며, 각 프레임의 처음 3개 색상 채널만 인코딩됩니다. 그런 다음 인코딩된 이미지는 해당 concat_mask와 함께 concat_latent_image로 positive 및 negative 컨디셔닝에 모두 추가됩니다. 마스크는 시작 이미지가 포함된 프레임의 경우 0.0으로 설정되고 나머지 프레임의 경우 1.0으로 설정됩니다. clip_vision_output이 제공되면 이 역시 positive 및 negative 컨디셔닝에 모두 추가됩니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
dbedf7f378ae9613c8f47fe9876a4576c815055b4cdb6bf687b7575fcd7ea80a