Gemini Omni Flash 多模态视频生成模型

结合文字、图片和视频参考生成电影感短片,并通过自然语言持续调整镜头与画面。

多模态输入 · 对话式编辑 · 灵活创作

融合文本、图片和视频参考的多模态创作空间

  官方披露能力

Gemini Omni Flash 的核心能力

以下来自厂商公开资料,不是 Gomni 自测结论。

对话式视频编辑

通过连续自然语言指令调整视频。

多模态参考

组合文本、图片和短视频参考来控制场景。

现实知识

Google 称模型可借助 Gemini 的历史、生物与叙事知识。

访问方式与价格

可在 Gomni 按量使用视频生成能力,也可通过 Google AI Studio 与 Gemini API 了解开发者接口。

开发者渠道

Google AI Studio / Gemini API

Gomni 工作台

按生成量使用,无需长期订阅

样张证据规则

本页图片用于解释流程,不冒充 Gemini 输出。只有完整记录 prompt、参数、端点与失败结果后,才会发布模型实测样张。

Prompt

保留完整提示词和参考输入。

参数

记录端点、版本、时长、比例和分辨率。

结果

成功与失败任务均进入样本。

三步开始使用 Gemini Omni Flash

01

选择输入

输入提示词、上传参考图片,或组合两者。

02

设置参数

选择时长、比例和分辨率后开始生成。

03

检查结果

核对首帧一致性、运动和构图,再下载或继续调整。

  FAQ

Gemini Omni Flash 常见问题

开始使用 Gemini Omni Flash 创作

按生成量付费,无需长期订阅。