内置节点参考

HeyGenAvatarVideoNode - ComfyUI Built-in Node Documentation

Complete documentation for the HeyGenAvatarVideoNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.

根据 HeyGen 虚拟形象生成一段主播式讲话视频。此节点利用 HeyGen 的渲染引擎,创建 AI 虚拟形象朗读您提供的文本或根据您自己的音频进行口型同步的视频。

输入

参数 描述 数据类型 是否必填 范围
引擎 渲染引擎;每个选项仅列出支持该引擎的虚拟形象。'auto' 会提供所有虚拟形象并为其选择最佳引擎(优先选择 Avatar IV)。Avatar V 保真度最高,Avatar III 性价比最高。 COMBO "auto"

"avatar_iv" "avatar_iii" "avatar_v" | | 自定义虚拟人 ID | 可选的 HeyGen 虚拟形象外观 ID。设置后,将覆盖上方选择的虚拟形象。可以使用 HeyGen 的 3000 多个公共外观(或您的私人虚拟形象)中的任意一个。 | STRING | 否 | | | 语音 | 通过文本脚本(HeyGen 文本转语音)或您自己的音频来驱动虚拟形象。 | COMBO | 是 | "script" "audio" | | 分辨率 | 输出视频分辨率(默认值:"1080p")。 | COMBO | 否 | "720p" "1080p" | | 宽高比 | 输出宽高比。'auto' 跟随虚拟形象的源素材(默认值:"auto")。 | COMBO | 否 | "auto" "16:9" "9:16" "1:1" "4:5" "5:4" | | 背景颜色 | 可选的纯色背景色,使用十六进制代码(例如 '#00ff00')。留空则使用虚拟形象自身的背景。 | STRING | 否 | | | 种子 | 不会发送给 HeyGen;更改此值可强制重新运行(默认值:42)。 | INT | 否 | 最小值:0 最大值:2147483647 |

speech 设置为 "script" 时,可使用以下子参数:

参数 描述 数据类型 是否必填 范围
text 虚拟形象要朗读的文本(最多 5000 个字符)。生成的语音时长至少为 1 秒。 STRING
voice 脚本使用的语音。默认选项使用 HeyGen 分配给该虚拟形象的语音。 COMBO 提供多个选项
custom_voice_id 可选的 HeyGen 语音 ID。设置后,将覆盖上方选择的语音。可以使用 HeyGen 语音库(2000+)中的任意语音。 STRING
voice_speed 语速倍数(默认值:1.0)。 FLOAT 最小值:0.5

最大值:1.5 步长:0.05 |

speech 设置为 "audio" 时,可使用以下子参数:

参数 描述 数据类型 是否必填 范围
audio 用于虚拟形象进行口型同步的音频,最长 10 分钟。 AUDIO

输出

输出名称 描述 数据类型
VIDEO 生成的虚拟形象主播视频。 VIDEO

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑


Source fingerprint (SHA-256): 009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61

官方原文

本页来自 Comfy-Org 官方中文文档的固定版本,并转换为 xueai 静态页面。内容以官方持续更新的页面为准。

内容授权与修改

官方文档采用 GPL-3.0。本站保留许可证、固定提交号和修改说明,不代表 ComfyUI 或 Comfy-Org 对本站背书。

GPL-3.0来源和修改说明