> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# HeyGenAvatarVideoNode - ComfyUI Built-in Node Documentation

> 从 HeyGen 虚拟形象生成会说话的主持人视频。

从 HeyGen 虚拟形象生成会说话的主持人视频。此节点使用 HeyGen 的渲染引擎，创建一个 AI 虚拟形象来朗读您提供的文本，或与您自己的音频进行口型同步的视频。

## 输入

### 通用输入

| 参数          | 描述                                                                                               | 数据类型           | 必填 | 范围                                                                          |
| ----------- | ------------------------------------------------------------------------------------------------ | -------------- | -- | --------------------------------------------------------------------------- |
| `引擎`        | 渲染引擎；每个选项仅列出支持该引擎的虚拟形象。“auto”提供所有虚拟形象并自动选择其最佳引擎（优先使用 Avatar IV）。Avatar V 保真度最高，Avatar III 价格最实惠。 | DYNAMIC\_COMBO | 是  | `"auto"`<br />`"avatar_iv"`<br />`"avatar_iii"`<br />`"avatar_v"`           |
| `自定义虚拟人 ID` | 可选的 HeyGen 虚拟形象外观 ID。设置后，将覆盖上方选定的虚拟形象。可以使用 HeyGen 的 3000 多个公开外观（或您的私有虚拟形象）中的任意一个。默认值：`""`。       | STRING         | 否  |                                                                             |
| `语音`        | 使用文本脚本（HeyGen 文本转语音）或您自己的音频来驱动虚拟形象。显示名称："speech source"。                                         | DYNAMIC\_COMBO | 是  | `"script"`<br />`"audio"`                                                   |
| `分辨率`       | 输出视频分辨率。默认值：`"1080p"`。                                                                           | COMBO          | 否  | `"720p"`<br />`"1080p"`                                                     |
| `宽高比`       | 输出宽高比。“auto”跟随虚拟形象的源素材。默认值：`"auto"`。                                                             | COMBO          | 否  | `"auto"`<br />`"16:9"`<br />`"9:16"`<br />`"1:1"`<br />`"4:5"`<br />`"5:4"` |
| `背景颜色`      | 可选的纯色背景颜色，使用十六进制代码（例如 `"#00ff00"`）。留空则使用虚拟形象自身的背景。如果提供，该值必须以 `#` 开头。默认值：`""`。                    | STRING         | 否  |                                                                             |
| `种子`        | 不会发送给 HeyGen；更改它可以强制重新运行。默认值：`42`。                                                               | INT            | 否  | 最小值：0<br />最大值：2147483647                                                   |

### `auto` 输入

当 `engine` 为 `"auto"` 时，以下子参数可用：

| 参数       | 描述                                               | 数据类型  | 必填 | 范围     |
| -------- | ------------------------------------------------ | ----- | -- | ------ |
| `avatar` | 用于呈现视频的虚拟形象外观（从 HeyGen 的公共库中精选）。会自动选择该外观支持的最佳引擎。 | COMBO | 是  | 多个可用选项 |

### `avatar_iv` 输入

当 `engine` 为 `"avatar_iv"` 时，以下子参数可用：

| 参数       | 描述                      | 数据类型  | 必填 | 范围     |
| -------- | ----------------------- | ----- | -- | ------ |
| `avatar` | 支持 Avatar IV 引擎的虚拟形象外观。 | COMBO | 是  | 多个可用选项 |

### `avatar_iii` 输入

当 `engine` 为 `"avatar_iii"` 时，以下子参数可用：

| 参数       | 描述                       | 数据类型  | 必填 | 范围     |
| -------- | ------------------------ | ----- | -- | ------ |
| `avatar` | 支持 Avatar III 引擎的虚拟形象外观。 | COMBO | 是  | 多个可用选项 |

### `avatar_v` 输入

当 `engine` 为 `"avatar_v"` 时，以下子参数可用：

| 参数       | 描述                     | 数据类型  | 必填 | 范围     |
| -------- | ---------------------- | ----- | -- | ------ |
| `avatar` | 支持 Avatar V 引擎的虚拟形象外观。 | COMBO | 是  | 多个可用选项 |

### `script` 输入

当 `speech` 为 `"script"` 时，以下子参数可用：

| 参数                | 描述                                                                   | 数据类型   | 必填 | 范围                                           |
| ----------------- | -------------------------------------------------------------------- | ------ | -- | -------------------------------------------- |
| `text`            | 虚拟形象要朗读的文本（最多 5000 个字符）。生成的语音至少需要 1 秒钟。默认值：`""`。                     | STRING | 是  | 最小值：1 个字符<br />最大值：5000 个字符                  |
| `voice`           | 脚本的语音。默认选项使用 HeyGen 分配给该虚拟形象的声音。如果设置了 `custom_voice_id`，则忽略此项。       | COMBO  | 是  | `"(avatar's default voice)"`<br />多个通用语音选项可用 |
| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后，将覆盖上方选定的语音。可以使用 HeyGen 库中的任意语音（2000+）。默认值：`""`。 | STRING | 否  |                                              |
| `voice_speed`     | 语速倍率。默认值：`1.0`。                                                      | FLOAT  | 否  | 最小值：0.5<br />最大值：1.5<br />步长：0.05            |

### `audio` 输入

当 `speech` 为 `"audio"` 时，以下子参数可用：

| 参数      | 描述                      | 数据类型  | 必填 | 范围 |
| ------- | ----------------------- | ----- | -- | -- |
| `audio` | 虚拟形象用于口型同步的音频，最长 10 分钟。 | AUDIO | 是  |    |

注意：`engine` 和 `speech` 是选择器，根据所选值显示不同的子参数。`speech` 选择器有两种互斥模式：在 `"script"` 模式下，`text` 为必填；如果提供了 `custom_voice_id`，则它会覆盖 `voice`。在 `"audio"` 模式下，虚拟形象会根据提供的音频片段进行口型同步。提供 `background_color` 时，它必须是 `#` 开头的十六进制颜色代码。设置 `custom_avatar_id` 后，它会覆盖 `avatar` 选择，且所选 `engine` 必须被该虚拟形象外观支持；否则除非 `engine` 为 `"auto"`，否则会引发错误。

## 输出

| 输出名称    | 描述            | 数据类型  |
| ------- | ------------- | ----- |
| `VIDEO` | 生成的虚拟形象主持人视频。 | VIDEO |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh.md)

***

**Source fingerprint (SHA-256):** `86dc799d3a8cf2666449b0d422853b12feffb81ce002f84594f9b925d58b522a`
