入力
注記:
start_imageとend_imageのどちらも提供されない場合、ノードはノイズマスクなしの空の潜在表現を返します。start_imageが提供されると、潜在表現の先頭フレームにエンコードされ、それらのフレームにはノイズマスク値 0(保持)が設定されます。end_imageが提供されると、末尾フレームにエンコードされ、それらのフレームにはノイズマスク値 0 が設定されます。残りのフレームのマスク値は 1 のままです。- 潜在表現は 16 チャンネルで、空間次元は
height / 8×width / 8です。潜在フレーム数は((length - 1) // 8) + 1です。 batch_sizeは、潜在表現と、存在する場合はノイズマスクを繰り返します。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
0b06ccfcb14c27c81eeebbbff519da1e187970d4cfc19c8796fc3da20688245c