Skip to main content
TextEncodeZImageOmni는 텍스트 프롬프트를 최대 세 개의 선택적 참조 이미지와 함께 이미지 생성 모델용 컨디셔닝 형식으로 인코딩합니다. 프롬프트는 CLIP 모델을 사용하여 토큰화되고 인코딩되며, 연결된 각 이미지는 선택적으로 비전 인코더 및/또는 VAE를 통해 처리되어 시각적 참조가 텍스트와 함께 임베딩됩니다. 이 노드는 실험적 기능으로 표시되어 있습니다.

입력

참고: 이 노드는 최대 세 개의 이미지(image1, image2, image3)를 허용합니다. image_encodervae 입력은 하나 이상의 이미지가 제공된 경우에만 사용됩니다. 둘 다 연결된 경우 각 이미지는 둘 모두에 의해 처리됩니다. auto_resize_images가 True이고 vae가 연결된 경우, 인코딩 전에 이미지의 전체 픽셀 면적이 1024x1024에 가깝도록 크기가 조정됩니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): b40a3150f536b6f37e2b53e6d9992fcb4fd32dceb540c0a76773a7ba1af9a7b8