입력
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
이 노드는 오디오 입력을 처리하여 비디오 생성 모델을 안내하는 데 사용할 수 있는 특징을 추출합니다. 오디오를 분석하여 템포, 비트 및 기타 음악적 특성을 감지한 다음, 이 정보를 비디오 모델을 컨디셔닝하는 데 적합한 형식으로 패키징하여 생성된 비디오가 오디오와 동기화되도록 합니다.
| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 |
|---|---|---|---|---|
audio | 분석 및 인코딩할 오디오 입력입니다. 오디오에 여러 채널이 있는 경우 특징 추출 전에 채널이 모노(mono)로 평균화됩니다. | AUDIO | 예 | - |
video_frames | 대상 비디오의 프레임 수입니다. 동기화를 위한 프레임 레이트 계산에 사용됩니다(기본값: 149). | INT | 예 | Min: 1, Max: 268435456 (MAX_RESOLUTION), Step: 4 |
audio_inject_scale | 비디오 모델에 주입될 때 오디오 특징의 스케일입니다(기본값: 1.0). | FLOAT | 예 | Min: 0.0, Max: 10.0, Step: 0.01 |
| 출력 이름 | 설명 | 데이터 타입 |
|---|---|---|
audio_encoder_output | 처리된 오디오 특징, 계산된 프레임 레이트(fps), 오디오 주입 스케일을 포함하는 사전(dictionary)입니다. 이 출력은 비디오 생성 모델을 컨디셔닝하는 데 사용됩니다. | AUDIO_ENCODER_OUTPUT |
fps_string | 오디오 길이와 비디오 프레임 수를 기반으로 계산된 프레임 레이트(fps)를 설명하는 텍스트 문자열입니다. 이 문자열은 비디오 모델의 프롬프트에서 사용하기 위한 것입니다. 참조 파이프라인과 일치하도록 중국어로 형식화되어 있습니다. | STRING |
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018