内置节点参考
GeminiVideoOmni - ComfyUI Built-in Node Documentation
Complete documentation for the GeminiVideoOmni node in ComfyUI. Learn its inputs, outputs, parameters and usage.
使用 Google 的 Gemini Omni Flash 模型,根据文本提示生成带音频的视频。可选择提供参考图像和/或视频来引导或编辑生成结果。请在提示中直接描述所需的时长(3-10 秒)和宽高比(16:9 或 9:16)。
## 输入
| 参数 | 描述 | 数据类型 | 是否必填 | 范围 |
|---|---|---|---|---|
model |
用于生成视频的 Gemini 视频模型。 | MODEL | 是 | "Omni Flash" |
seed |
种子控制节点是否应重新运行;无论种子如何,结果均非确定性(默认值:42)。 | INT | 是 | 0 至 2147483647 |
prompt |
描述要生成视频的文本提示。 去除开头和结尾的空白字符后,至少需要一个非空白字符。 | STRING | 是 | 去除首尾空格后至少 1 个字符 |
images |
可选参考图像,用于引导视频生成。最多 14 张图像。 | IMAGE | 否 | 允许多张图像(最多 14 张) |
videos |
可选参考视频,用于引导或编辑视频生成。最多 3 个视频,每个最长 10 秒。 | VIDEO | 否 | 允许多个视频(最多 3 个,每个最长 10 秒) |
temperature |
控制生成过程中的随机性(默认值:1.0)。 | FLOAT | 否 | 0.0 至 2.0 |
top_p |
核采样参数(默认值:0.95)。 | FLOAT | 否 | 0.0 至 1.0 |
## 输出
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
VIDEO |
由 Gemini 模型生成的带音频的视频。 | VIDEO |
STRING |
模型的任何文本响应,例如推理过程或解释。 | STRING |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256): 046842b7ec736283bba355aaa038b02fcf2416020f5f7aee7b0150d2a05bcbe6
官方原文
本页来自 Comfy-Org 官方中文文档的固定版本,并转换为 xueai 静态页面。内容以官方持续更新的页面为准。