Skip to main content
TextEncodeHunyuanVideo_ImageToVideo ノードは、テキストプロンプトと参照画像からの視覚情報を組み合わせることで、画像から動画への生成用のコンディショニングデータを作成します。CLIP モデルを使用して、テキストと CLIP ビジョン出力からの画像埋め込みの両方を処理し、image_interleave 設定に従ってこれら2つのソースを融合したトークンを生成します。

入力

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73