Skip to main content
TextEncodeHunyuanVideo_ImageToVideo 노드는 텍스트 프롬프트와 참조 이미지의 시각적 정보를 결합하여 이미지-투-비디오 생성용 컨디셔닝 데이터를 생성합니다. CLIP 모델을 사용하여 텍스트와 CLIP 비전 출력의 이미지 임베딩을 모두 처리한 다음, image_interleave 설정에 따라 이 두 소스를 혼합하는 토큰을 생성합니다.

입력

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73