> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanPhantomSubjectToVideo - ComfyUI Built-in Node Documentation

> WanPhantomSubjectToVideo 节点为 Wan 视频生成准备条件数据和潜变量。

WanPhantomSubjectToVideo 节点为 Wan 视频生成准备条件数据和潜变量。它根据请求的宽度、高度、长度和批大小创建一个空潜变量视频，并且当提供参考图像时，使用 VAE 对其进行编码，并将其作为时间维度的视觉引导添加到条件中。

## 输入

| 参数      | 描述                        | 数据类型         | 必需 | 范围                            |
| ------- | ------------------------- | ------------ | -- | ----------------------------- |
| `正面提示词` | 用于引导视频生成的正向条件输入           | CONDITIONING | 是  | -                             |
| `负面提示词` | 用于避免某些特征的负向条件输入           | CONDITIONING | 是  | -                             |
| `VAE`   | 当提供参考图像时，用于编码参考图像的 VAE 模型 | VAE          | 是  | -                             |
| `宽度`    | 输出视频宽度（像素，默认值：832）        | INT          | 是  | 16 to MAX\_RESOLUTION （步长：16） |
| `高度`    | 输出视频高度（像素，默认值：480）        | INT          | 是  | 16 to MAX\_RESOLUTION （步长：16） |
| `长度`    | 生成视频的帧数（默认值：81）           | INT          | 是  | 1 to MAX\_RESOLUTION （步长：4）   |
| `批次大小`  | 同时生成的视频数量（默认值：1）          | INT          | 是  | 1 到 4096                      |
| `图像`    | 可选的参考图像，用作时间维度的视觉引导       | IMAGE        | 否  | -                             |

**注意：** 当提供 `images` 时，它们会自动放大以匹配指定的 `width` 和 `height`，并且只使用前 `length` 张图像进行处理。每张图像都会使用 `vae` 进行编码，并沿时间维度拼接，且每张图像仅使用其 RGB 通道。当未提供 `images` 时，三个条件输出都会原样返回输入条件。

## 输出

| 输出名称                | 描述                                                                | 数据类型         |
| ------------------- | ----------------------------------------------------------------- | ------------ |
| `positive`          | 当提供图像时，正向条件会沿时间维度拼接编码后的参考图像；否则原样返回输入的 `positive`                  | CONDITIONING |
| `negative_text`     | 当提供图像时，负向条件会沿时间维度拼接编码后的参考图像；否则原样返回输入的 `negative`                  | CONDITIONING |
| `negative_img_text` | 当提供图像时，负向条件会使用置零的时间维度拼接；否则原样返回输入的 `negative`                      | CONDITIONING |
| `latent`            | 具有 16 个通道的零填充潜变量视频张量；其帧数由 `length` 决定，空间尺寸由 `height` 和 `width` 决定 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanPhantomSubjectToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `a1853382f6e564f66262b69dd7b06cc58e26b93386a460a98e6fcc2ff6acf12b`
