Skip to main content
CLIPTextEncodeHiDream 노드는 서로 다른 언어 모델(CLIP-L, CLIP-G, T5-XXL 및 LLaMA)을 사용하여 네 개의 별도 텍스트 입력을 처리하고 이를 단일 컨디셔닝 출력으로 결합합니다. 각 텍스트 입력을 해당 모델로 토큰화하고 스케줄된 인코딩 방식을 사용하여 함께 인코딩함으로써, 여러 언어 모델을 동시에 활용하여 더 정교한 텍스트 컨디셔닝을 가능하게 합니다.

입력

참고: 네 개의 텍스트 입력(clip_l, clip_g, t5xxl, llama)은 모두 정상 작동을 위해 필요합니다. 각 입력은 스케줄된 인코딩 과정을 통해 최종 컨디셔닝 출력에 기여하기 때문입니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): c5e269c17bd2dd7d7171c02598a87983a988d953dd7df285978fc25a9c896e46