内置节点参考

HeyGenTalkingPhotoNode - ComfyUI Built-in Node Documentation

Complete documentation for the HeyGenTalkingPhotoNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.

概述

使用 HeyGen 的 Avatar IV 技术,将人物静态图像动画化为唇形同步的说话视频。您可以通过 HeyGen 转换为语音的文本来驱动动画,也可以提供自己的音频让虚拟形象进行唇形同步。

输入

参数 描述 数据类型 是否必填 取值范围
图像 要动画化的人物图像。如果大于 2K 将自动缩小。 IMAGE -
语音 通过文本脚本(HeyGen 文本转语音)或您自己的音频驱动虚拟形象。 COMBO "script"
"audio"
text 虚拟形象要说的文本(最多 5000 个字符)。生成的语音必须至少 1 秒长。 STRING 是(当 speech 为 "script" 时) -
voice 脚本使用的语音(HeyGen 最受欢迎的语音)。 COMBO 是(当 speech 为 "script" 时) 提供多个选项
custom_voice_id 可选的 HeyGen 语音 ID。设置后将覆盖上面选择的语音。可以使用 HeyGen 库中的任何语音(2000+)。 STRING -
voice_speed 语速倍率(默认值:1.0)。 FLOAT 0.5 至 1.5
audio 虚拟形象唇形同步的音频,最长 10 分钟。 AUDIO 是(当 speech 为 "audio" 时) -
分辨率 输出视频分辨率(默认值:"1080p")。 COMBO "720p"
"1080p"
宽高比 输出宽高比。'auto' 跟随输入图像(默认值:"auto")。 COMBO "auto"

"16:9" "9:16" "1:1" "4:5" "5:4" | | 表现力 | 动画面部和手势的表现力程度(默认值:"low")。 | COMBO | 否 | "low" "medium" "high" | | 种子 | 不会发送到 HeyGen;更改它以强制重新运行(默认值:42)。 | INT | 否 | 0 至 2147483647 |

输出

输出名称 描述 数据类型
video 生成的动画说话照片视频,包含唇形同步的语音。 VIDEO

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑


Source fingerprint (SHA-256): 2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a

官方原文

本页来自 Comfy-Org 官方中文文档的固定版本,并转换为 xueai 静态页面。内容以官方持续更新的页面为准。

内容授权与修改

官方文档采用 GPL-3.0。本站保留许可证、固定提交号和修改说明,不代表 ComfyUI 或 Comfy-Org 对本站背书。

GPL-3.0来源和修改说明