Skip to main content
CosmosImageToVideoLatent ノードは、入力画像からビデオの潜在表現を生成します。指定された幅・高さ・フレーム数で空のビデオ潜在表現を作成し、必要に応じて開始画像を先頭フレームに、終了画像を末尾フレームにエンコードします。画像が提供された場合は、エンコードされたフレームが生成中に固定されるようにノイズマスクも生成されます。

入力

注記:
  • start_imageend_image のどちらも提供されない場合、ノードはノイズマスクなしの空の潜在表現を返します。
  • start_image が提供されると、潜在表現の先頭フレームにエンコードされ、それらのフレームにはノイズマスク値 0(保持)が設定されます。end_image が提供されると、末尾フレームにエンコードされ、それらのフレームにはノイズマスク値 0 が設定されます。残りのフレームのマスク値は 1 のままです。
  • 潜在表現は 16 チャンネルで、空間次元は height / 8 × width / 8 です。潜在フレーム数は ((length - 1) // 8) + 1 です。
  • batch_size は、潜在表現と、存在する場合はノイズマスクを繰り返します。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 0b06ccfcb14c27c81eeebbbff519da1e187970d4cfc19c8796fc3da20688245c