> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# TextEncodeHunyuanVideo_ImageToVideo - ComfyUI Built-in Node Documentation

> TextEncodeHunyuanVideoImageToVideo 节点通过将文本提示与参考图像的视觉信息相结合，为图像转视频生成创建条件数据。

TextEncodeHunyuanVideo\_ImageToVideo 节点通过将文本提示与参考图像的视觉信息相结合，为图像转视频生成创建条件数据。它使用 CLIP 模型同时处理文本和来自 CLIP 视觉输出的图像嵌入，然后根据 `image_interleave` 设置生成融合这两种来源的 token。

## 输入

| 参数         | 描述                                                                                  | 数据类型                 | 必填 | 范围    |
| ---------- | ----------------------------------------------------------------------------------- | -------------------- | -- | ----- |
| `clip`     | 用于分词和编码的 CLIP 模型。                                                                   | CLIP                 | 是  | -     |
| `clip视觉输出` | 来自 CLIP 视觉模型的视觉嵌入，为参考图像提供图像上下文。                                                     | CLIP\_VISION\_OUTPUT | 是  | -     |
| `提示`       | 用于指导视频生成的文本描述。支持多行输入和动态提示。提示使用模板进行格式化，该模板要求模型基于参考图像描述视频，涵盖主要内容、物体细节、动作、背景和摄像机角度等方面。 | STRING               | 是  | -     |
| `图像交错`     | 图像相对于文本提示的影响程度。数值越高，表示文本提示的影响越大。（默认值：2）                                             | INT                  | 是  | 1-512 |

## 输出

| 输出名            | 描述                    | 数据类型         |
| -------------- | --------------------- | ------------ |
| `CONDITIONING` | 结合文本和图像信息用于视频生成的条件数据。 | CONDITIONING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeHunyuanVideo_ImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73`
