> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanImageToVideo - ComfyUI Built-in Node Documentation

> WanImageToVideo 节点为视频生成任务准备 conditioning 和 latent 表示。

WanImageToVideo 节点为视频生成任务准备 conditioning 和 latent 表示。它创建一个空白的 latent 空间用于视频生成，并可选地结合起始图像和 CLIP 视觉输出以引导视频生成过程。该节点根据提供的图像和视觉数据修改正向和负向 conditioning 输入。

## 输入

| 参数         | 描述                                                                                        | 数据类型                 | 必需 | 范围                    |
| ---------- | ----------------------------------------------------------------------------------------- | -------------------- | -- | --------------------- |
| `正面`       | 用于引导生成的正向 conditioning 输入                                                                 | CONDITIONING         | 是  | -                     |
| `负面`       | 用于引导生成的负向 conditioning 输入                                                                 | CONDITIONING         | 是  | -                     |
| `vae`      | 用于将图像编码到 latent 空间的 VAE 模型                                                                | VAE                  | 是  | -                     |
| `宽度`       | 输出视频的宽度（默认：832，步长：16）                                                                     | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `高度`       | 输出视频的高度（默认：480，步长：16）                                                                     | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `长度`       | 视频中的帧数（默认：81，步长：4）                                                                        | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `批量大小`     | 每批生成的视频数量（默认：1）                                                                           | INT                  | 是  | 1 到 4096              |
| `clip视觉输出` | 用于附加 conditioning 的可选 CLIP 视觉输出                                                           | CLIP\_VISION\_OUTPUT | 否  | -                     |
| `开始图像`     | 用于初始化视频生成的可选起始图像。提供时，图像会被缩放以匹配指定的宽度和高度，视频的前几帧将由此图像初始化。其余帧填充为中灰色（0.5）值。超出 `length` 的帧将被忽略。 | IMAGE                | 否  | -                     |

**注意：** 当提供 `start_image` 时，节点使用 VAE 对图像序列进行编码，并对 conditioning 输入应用掩码。该掩码覆盖除起始图像初始化帧之外的所有帧，从而允许生成过程基于所提供的图像进行构建。编码时仅使用图像的前三个颜色通道（RGB）。当提供 `clip_vision_output` 参数时，会向正向和负向输入添加基于视觉的 conditioning。

## 输出

| 输出名称 | 描述                                                                                     | 数据类型         |
| ---- | -------------------------------------------------------------------------------------- | ------------ |
| `正面` | 已合并图像和视觉数据的修正后正向 conditioning                                                          | CONDITIONING |
| `负面` | 已合并图像和视觉数据的修正后负向 conditioning                                                          | CONDITIONING |
| `潜在` | 准备好用于视频生成的空 latent 空间张量，形状为 \[batch\_size, 16, ((length-1)//4)+1, height//8, width//8] | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `46779f9f2f3da16826b7b547761a96597a3b6b43ce51a9c13367987642f3d5b7`
