内置节点参考

GeminiVideoOmni - ComfyUI Built-in Node Documentation

Complete documentation for the GeminiVideoOmni node in ComfyUI. Learn its inputs, outputs, parameters and usage.

使用 Google 的 Gemini Omni Flash 模型,根据文本提示生成带音频的视频。可选择提供参考图像和/或视频来引导或编辑生成结果。请在提示中直接描述所需的时长(3-10 秒)和宽高比(16:9 或 9:16)。

## 输入

参数 描述 数据类型 是否必填 范围
model 用于生成视频的 Gemini 视频模型。 MODEL "Omni Flash"
seed 种子控制节点是否应重新运行;无论种子如何,结果均非确定性(默认值:42)。 INT 0 至 2147483647
prompt 描述要生成视频的文本提示。 去除开头和结尾的空白字符后,至少需要一个非空白字符。 STRING 去除首尾空格后至少 1 个字符
images 可选参考图像,用于引导视频生成。最多 14 张图像。 IMAGE 允许多张图像(最多 14 张)
videos 可选参考视频,用于引导或编辑视频生成。最多 3 个视频,每个最长 10 秒。 VIDEO 允许多个视频(最多 3 个,每个最长 10 秒)
temperature 控制生成过程中的随机性(默认值:1.0)。 FLOAT 0.0 至 2.0
top_p 核采样参数(默认值:0.95)。 FLOAT 0.0 至 1.0

## 输出

输出名称 描述 数据类型
VIDEO 由 Gemini 模型生成的带音频的视频。 VIDEO
STRING 模型的任何文本响应,例如推理过程或解释。 STRING

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑


Source fingerprint (SHA-256): 046842b7ec736283bba355aaa038b02fcf2416020f5f7aee7b0150d2a05bcbe6

官方原文

本页来自 Comfy-Org 官方中文文档的固定版本,并转换为 xueai 静态页面。内容以官方持续更新的页面为准。

内容授权与修改

官方文档采用 GPL-3.0。本站保留许可证、固定提交号和修改说明,不代表 ComfyUI 或 Comfy-Org 对本站背书。

GPL-3.0来源和修改说明