对话式视频编辑
通过连续自然语言指令调整视频。
结合文字、图片和视频参考生成电影感短片,并通过自然语言持续调整镜头与画面。
多模态输入 · 对话式编辑 · 灵活创作

● 官方披露能力
以下来自厂商公开资料,不是 Gomni 自测结论。
通过连续自然语言指令调整视频。
组合文本、图片和短视频参考来控制场景。
Google 称模型可借助 Gemini 的历史、生物与叙事知识。
可在 Gomni 按量使用视频生成能力,也可通过 Google AI Studio 与 Gemini API 了解开发者接口。
Google AI Studio / Gemini API
按生成量使用,无需长期订阅
本页图片用于解释流程,不冒充 Gemini 输出。只有完整记录 prompt、参数、端点与失败结果后,才会发布模型实测样张。
保留完整提示词和参考输入。
记录端点、版本、时长、比例和分辨率。
成功与失败任务均进入样本。
输入提示词、上传参考图片,或组合两者。
选择时长、比例和分辨率后开始生成。
核对首帧一致性、运动和构图,再下载或继续调整。
● FAQ