> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanAnimateToVideo - ComfyUI Built-in Node Documentation

> WanAnimateToVideo 节点用于准备 conditioning 数据和初始 latent，以使用 Wan 生成动画视频，输入包括参考图像、姿态、人脸、背景以及可选的前一个块的运动。

WanAnimateToVideo 节点用于准备 conditioning 数据和初始 latent，以使用 Wan 生成动画视频，输入包括参考图像、姿态、人脸、背景以及可选的前一个块的运动。它还支持通过读取和更新 `video_frame_offset` 值来分块生成长视频。该节点标记为实验性。

## 输入

| 参数         | 描述                                                                            | 数据类型                 | 必填 | 范围                    |
| ---------- | ----------------------------------------------------------------------------- | -------------------- | -- | --------------------- |
| `正向提示`     | 用于引导生成朝向期望内容的正向 conditioning。                                                 | CONDITIONING         | 是  | -                     |
| `负向提示`     | 用于使生成远离不想要内容的负向 conditioning。                                                 | CONDITIONING         | 是  | -                     |
| `VAE`      | 用于将图像和视频输入编码到潜在空间的 VAE 模型。                                                    | VAE                  | 是  | -                     |
| `宽度`       | 生成视频的宽度（像素）（默认值：832，步长：16）。                                                   | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `高度`       | 生成视频的高度（像素）（默认值：480，步长：16）。                                                   | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `长度`       | 要生成的帧数（默认值：77，步长：4）。                                                          | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `批次大小`     | 一个批次中要生成的视频数量（默认值：1）。                                                         | INT                  | 是  | 1 到 4096              |
| `CLIP视觉输出` | 可选的 CLIP vision 输出，会同时添加到正向和负向 conditioning 中。                                | CLIP\_VISION\_OUTPUT | 否  | -                     |
| `参考图像`     | 用作生成视频外观起点的参考图像。如果未提供，则使用黑色图像。                                                | IMAGE                | 否  | -                     |
| `面部视频`     | 提供面部表情引导的视频输入。内部会将其调整为 512x512，并缩放到 -1.0 到 1.0 的范围。                           | IMAGE                | 否  | -                     |
| `姿态视频`     | 提供姿态和运动引导的视频输入。                                                               | IMAGE                | 否  | -                     |
| `继续运动最大帧数` | 从前一个运动序列延续的最大帧数（默认值：5，步长：4）。                                                  | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `背景视频`     | 用于填充帧中非角色部分的背景视频。                                                             | IMAGE                | 否  | -                     |
| `角色遮罩`     | 定义角色区域的遮罩，用于将角色与背景分离。                                                         | MASK                 | 否  | -                     |
| `继续运动`     | 用于继续生成的前一个运动帧，保持与之前生成块的时间一致性。                                                 | IMAGE                | 否  | -                     |
| `视频帧偏移`    | 在所有输入视频中跳过的帧数。用于分块生成更长的视频。连接到上一个节点的 `video_frame_offset` 输出以扩展视频。（默认值：0，步长：1） | INT                  | 是  | 0 to MAX\_RESOLUTION  |

**参数约束：**

* 当提供 `continue_motion` 时，仅使用其最后 `continue_motion_max_frames` 帧。
* 输入视频（`face_video`、`pose_video`、`background_video`、`character_mask`）在使用前会按 `video_frame_offset` 进行偏移。如果偏移量大于或等于输入的帧数，则忽略该输入，但单帧的 `character_mask` 除外。
* 如果 `character_mask` 只有一帧，则该帧会重复用于输出的每一帧。
* 当 `pose_video` 短于 `length` 时，其最后一帧会重复以填充剩余帧；输出长度不变。
* 如果提供了 `clip_vision_output`，它会同时添加到正向和负向 conditioning 中。
* 如果未提供 `reference_image`，则使用黑色图像（所有值为零）作为默认参考。
* 如果未提供 `continue_motion`，则初始运动帧会以恒定灰色（强度 0.5）帧填充。
* 使用 `continue_motion` 时，在计算下一个块偏移之前，`video_frame_offset` 会减去延续的帧数，从而避免重叠帧被重复处理。
* `background_video` 在参考运动部分之后填充运动帧；它不会替换参考图像或延续的 `continue_motion` 帧。

## 输出

| 输出名称    | 描述                                                                                                             | 数据类型         |
| ------- | -------------------------------------------------------------------------------------------------------------- | ------------ |
| `正向提示`  | 添加了额外视频上下文的正向 conditioning，包括 CLIP vision 输出、姿态视频 latent、人脸视频像素、拼接的 latent 图像和拼接的遮罩。                           | CONDITIONING |
| `负向提示`  | 添加了额外视频上下文的负向 conditioning，包括 CLIP vision 输出、姿态视频 latent、空白人脸像素、拼接的 latent 图像和拼接的遮罩。                           | CONDITIONING |
| `潜变量`   | 用于生成视频的初始 latent 张量（所有样本均为零），形状为 `[batch_size, 16, latent_length + trim_latent, latent_height, latent_width]`。 | LATENT       |
| `修剪潜变量` | 需要从 latent 开头裁剪的 latent 帧数，对应参考图像帧。                                                                            | INT          |
| `修剪图像`  | 需要从开头裁剪的图像帧数，对应参考运动帧。                                                                                          | INT          |
| `视频帧偏移` | 根据输入偏移和已处理帧数计算出的、用于下一个块的更新后帧偏移量。                                                                               | INT          |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanAnimateToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `a95bae4c7ae4ddc8a95bc9dafa2ca920b1d2166802615189537dce16949bfc03`
