> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanPhantomSubjectToVideo - ComfyUI Built-in Node Documentation

> WanPhantomSubjectToVideo 节点会为 Wan 视频生成准备 conditioning 数据和 latent。

WanPhantomSubjectToVideo 节点会为 Wan 视频生成准备 conditioning 数据和 latent。它会根据请求的宽度、高度、长度和批量大小创建一个空的 latent 视频，并且在提供参考图像时，使用 VAE 对参考图像进行编码，并将其作为时间维度的视觉引导添加到 conditionings 中。

## 输入

| 参数      | 描述                            | 数据类型         | 是否必需 | 范围                   |
| ------- | ----------------------------- | ------------ | ---- | -------------------- |
| `正面提示词` | 用于引导视频生成的正面 conditioning 输入   | CONDITIONING | 是    | -                    |
| `负面提示词` | 用于避免特定特征的负面 conditioning 输入   | CONDITIONING | 是    | -                    |
| `VAE`   | 在提供参考图像时用于编码参考图像的 VAE 模型      | VAE          | 是    | -                    |
| `宽度`    | 输出视频宽度（像素，默认值：832，必须是 16 的倍数） | INT          | 是    | 16 至 MAX\_RESOLUTION |
| `高度`    | 输出视频高度（像素，默认值：480，必须是 16 的倍数） | INT          | 是    | 16 至 MAX\_RESOLUTION |
| `长度`    | 生成视频的帧数（默认值：81，必须是 4 的倍数）     | INT          | 是    | 1 至 MAX\_RESOLUTION  |
| `批次大小`  | 同时生成的视频数量（默认值：1）              | INT          | 是    | 1 至 4096             |
| `图像`    | 可选参考图像，用作时间维度的视觉引导            | IMAGE        | 否    | -                    |

**注意：** 当提供 `images` 时，它们会自动放大以匹配指定的 `width` 和 `height`，并且仅使用前 `length` 张图像进行处理。每张图像都会使用 `vae` 进行编码，并沿时间维度进行拼接，且仅使用每张图像的 RGB 通道。

## 输出

| 输出名称     | 描述                                                                      | 数据类型         |
| -------- | ----------------------------------------------------------------------- | ------------ |
| `正面提示词`  | 当提供图像时，包含编码参考图像的时间维度拼接的正面 conditioning；否则原样返回输入的 `positive`             | CONDITIONING |
| `负面文本`   | 当提供图像时，包含编码参考图像的时间维度拼接的负面 conditioning；否则原样返回输入的 `negative`             | CONDITIONING |
| `负面图像文本` | 当提供图像时，包含置零的时间维度拼接的负面 conditioning；否则原样返回输入的 `negative`                 | CONDITIONING |
| `潜变量`    | 零填充的 latent 视频张量，具有 16 个通道；其帧数由 `length` 决定，空间尺寸由 `height` 和 `width` 决定 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanPhantomSubjectToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `a1853382f6e564f66262b69dd7b06cc58e26b93386a460a98e6fcc2ff6acf12b`
