Skip to main content
TextEncodeHunyuanVideo_ImageToVideo 节点通过将文本提示与参考图像的视觉信息相结合,为图像转视频生成创建条件数据。它使用 CLIP 模型同时处理文本和来自 CLIP 视觉输出的图像嵌入,然后根据 image_interleave 设置生成融合这两种来源的 token。

输入

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73