内置节点参考
HeyGenTalkingPhotoNode - ComfyUI Built-in Node Documentation
Complete documentation for the HeyGenTalkingPhotoNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.
概述
使用 HeyGen 的 Avatar IV 技术,将人物静态图像动画化为唇形同步的说话视频。您可以通过 HeyGen 转换为语音的文本来驱动动画,也可以提供自己的音频让虚拟形象进行唇形同步。
输入
| 参数 | 描述 | 数据类型 | 是否必填 | 取值范围 |
|---|---|---|---|---|
图像 |
要动画化的人物图像。如果大于 2K 将自动缩小。 | IMAGE | 是 | - |
语音 |
通过文本脚本(HeyGen 文本转语音)或您自己的音频驱动虚拟形象。 | COMBO | 是 | "script" |
"audio" |
||||
text |
虚拟形象要说的文本(最多 5000 个字符)。生成的语音必须至少 1 秒长。 | STRING | 是(当 speech 为 "script" 时) | - |
voice |
脚本使用的语音(HeyGen 最受欢迎的语音)。 | COMBO | 是(当 speech 为 "script" 时) | 提供多个选项 |
custom_voice_id |
可选的 HeyGen 语音 ID。设置后将覆盖上面选择的语音。可以使用 HeyGen 库中的任何语音(2000+)。 | STRING | 否 | - |
voice_speed |
语速倍率(默认值:1.0)。 | FLOAT | 否 | 0.5 至 1.5 |
audio |
虚拟形象唇形同步的音频,最长 10 分钟。 | AUDIO | 是(当 speech 为 "audio" 时) | - |
分辨率 |
输出视频分辨率(默认值:"1080p")。 | COMBO | 否 | "720p" |
"1080p" |
||||
宽高比 |
输出宽高比。'auto' 跟随输入图像(默认值:"auto")。 | COMBO | 否 | "auto" |
"16:9" "9:16" "1:1" "4:5" "5:4" | | 表现力 | 动画面部和手势的表现力程度(默认值:"low")。 | COMBO | 否 | "low" "medium" "high" | | 种子 | 不会发送到 HeyGen;更改它以强制重新运行(默认值:42)。 | INT | 否 | 0 至 2147483647 |
输出
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
video |
生成的动画说话照片视频,包含唇形同步的语音。 | VIDEO |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256): 2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a
官方原文
本页来自 Comfy-Org 官方中文文档的固定版本,并转换为 xueai 静态页面。内容以官方持续更新的页面为准。