入力
注記:
start_image または end_image の少なくとも一方が提供されると、ノードは結合フレームシーケンスを構築します。開始フレームと終了フレームが埋められ、残りのフレームにはニュートラルグレー(0.5)のプレースホルダーが使用されます。マスクは、埋められた領域を既知、プレースホルダー領域を未知としてマークし、ビデオモデルが中間フレームを生成できるようにします。開始画像が提供された場合、既知領域は画像の3フレーム分も拡張されます。エンコードされたフレーム画像とマスクは、positive と negative の両方のコンディショニングに添付されます。両方のCLIPビジョン入力が提供された場合は、それらの隠れ状態が連結されます。一方のみが提供された場合は、そのまま使用されます。潜在ビデオの長さは、時間圧縮後に length から導出されます: ((length - 1) // 4) + 1。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
0072e441cb80334c3c961d1bbf2d081c78bc38ed1eacca840c577a2d01b36f05