Gemini Omni 1.1 Flash是一款由谷歌于2026年8月推出的AI 视频生成模型,主要用于从文本、图像或已有视频生成与连续编辑高分辨率视频,支持场景扩展、首尾帧指定与参考视频一致性控制,适用于广告分镜、社媒短视频、影视预可视化与产品演示等需要快速迭代视频内容的场景。
| 基础信息 | 内容 |
|---|---|
| 开发团队 | 谷歌(Google DeepMind) |
| 发布时间 | 2026年8月27日(谷歌当地时间宣布) |
| 产品定位 | AI 视频生成模型(高分辨率直出 + 连续编辑) |
| 最高分辨率 | 4K(2160p) |
| 单次生成 | 每次延长 10 秒,单条累计最长 40 秒 |
| 支持分辨率 | 360p / 720p / 1080p / 4K |
| 计费方式 | 按秒计费 |
| 调用入口 | Flow(labs.google/fx/tools/flow)、Gemini API、Vertex AI、Google AI Studio |

Gemini Omni 1.1 Flash的核心能力
Gemini Omni 1.1 Flash 把”生成”与”编辑”收拢到同一模型,既可以从零生成,也能在已有片段上连续扩展与改写,与 可灵 3.0 模型 等支持片段延长的视频模型思路相近,但强调无缝续写。
场景扩展与连续生成
场景扩展是 1.1 Flash 的核心能力:用户可直接基于已有视频,从结尾处无缝衔接并继续生成后续画面,每次以 10 秒为步长逐步扩展,单条视频累计最长可达 40 秒,适合把短视频拉长成完整叙事,或在大模型生成后做可控续写,而非每次从零重生成。
首尾帧指定与运镜
只需指定镜头的起始帧与结束帧,Gemini Omni 1.1 Flash 即可完成平滑自然的转场与镜头运镜,让创作者对画面起止有精确控制,减少随机生成带来的不可控感,也更便于与分镜脚本对齐。
高速预览与4K直出
在 360p 预览模式下,生成速度较标准 720p 最高提升 60%,成本仅需三分之一,适合分镜脚本快速迭代与高速渲染;最终成片则可直出画质细腻的 1080p 或 4K,与同属谷歌视频矩阵的 Veo3 形成高低搭配。
参考视频一致性
构建视频场景时,可引入最长 3 秒的参考视频片段,依据参考内容精准维持画面的上下文背景与角色一致性,降低多镜头之间的角色与场景跳变,对系列化短视频与固定角色内容尤为重要。
Gemini Omni 1.1 Flash与主流视频模型的对比
把 Gemini Omni 1.1 Flash 与同档位的国产视频模型、国际视频模型放在一张表里对比,三者都按秒计费,但在分辨率、单条时长与价格梯度上差异明显。
| 对比维度 | Gemini Omni 1.1 Flash | 可灵 3.0 | Veo 3 |
|---|---|---|---|
| 最高分辨率 | 4K | 4K | 4K(Veo 3.1) |
| 单条时长 | 最长 40 秒(10 秒步长扩展) | 最长 15 秒(可延长) | 约 8 秒原生(可扩展) |
| 首尾帧/参考视频 | 支持首尾帧 + 3 秒参考视频 | 支持参考视频与多主体锚定 | 支持参考图像首帧 |
| 360p 预览 | 速度 +60%、成本 1/3 | 未提供 | 未提供 |
| 价格(720p) | $0.10 / 秒 | 约 ¥0.6–1.0 / 秒 | $0.10 / 秒(Fast) |
| 价格(4K) | $0.30 / 秒 | 约 ¥3.0 / 秒 | $0.30 / 秒(Fast) |
注:以上分辨率、单次时长与每秒定价取自 Google 官方说明(经 IT之家 2026年8月28日报道援引);可灵 3.0、Veo 3、Wan3.0 数据来自各自官方页面。四款模型均按秒计费,差异集中在单次生成时长上限、参考视频一致性与最高分辨率——Gemini Omni 1.1 Flash 以”边生成边续写”和首尾帧控制见长,更适合分镜快速迭代。
从官方数据可以看出,三款模型在”可控续写”与”高分辨率直出”上各有侧重。Gemini Omni 1.1 Flash 以 40 秒累计时长、首尾帧指定与 3 秒参考视频强调可控的连续编辑,并用 360p 预览把迭代成本压到三分之一;可灵 3.0 在参考视频与多主体锚定上更成熟,4K 单价约 ¥3.0/秒;Veo 3 则凭原生同步音频形成差异化,最高同样支持 4K。对需要高分辨率直出与可控续写的团队,Gemini Omni 1.1 Flash 与可灵 3.0 模型、Veo3 是最直接的对照选择,亦可参考 Wan3.0 等开源视频方案。
Gemini Omni 1.1 Flash的应用场景与适用人群
Gemini Omni 1.1 Flash 把生成与编辑合一,以下场景最能发挥价值:
- 广告与社媒短视频:用 360p 预览快速迭代分镜,再直出 4K 成片。
- 影视预可视化:指定首尾帧生成转场与运镜,降低分镜沟通成本。
- 产品演示:基于已有素材续写,快速产出多版本讲解视频。
- 角色一致性内容:挂载参考视频锁定角色与场景,做系列化短视频。
适用人群:主要面向三类用户。一是广告与社媒内容团队——他们需要快速迭代分镜并以可控成本产出高分辨率成片;二是影视与动画从业者——他们看重首尾帧指定与参考视频带来的镜头可控性;三是产品与电商团队——他们常用”基于已有素材续写”快速生成多版本演示。
如何使用Gemini Omni 1.1 Flash
前提条件:
- 账号准备:一个 Google 账号,用于登录 Flow 或 Google AI Studio。
- 网络环境:可访问 Google 服务(Flow、Gemini API)的海外网络环境。
- 付费准备:API 调用按秒计费,建议先了解各分辨率档位的单价。
操作步骤:
- 打开入口:访问 Google Flow 并用 Google 账号登录,选择 Gemini Omni 模型。
- 选择模式:在 Flow 中新建视频项目,或从已有片段进入”扩展/续写”模式。
- 设定镜头:输入提示词,或上传首尾帧图像、参考视频以锁定角色与场景一致性。
- 选择分辨率:先用 360p 预览快速验证,再切换到 1080p 或 4K 直出成片。
- 生成与导出:按 10 秒步长扩展至所需时长(最长 40 秒),导出最终视频。
当前定价与限制:Gemini Omni 1.1 Flash 按秒计费,360p $0.03/秒、720p $0.1/秒、1080p $0.15/秒、4K $0.3/秒;单次以 10 秒为步长扩展,单条累计最长 40 秒;Flow 免费档提供每日额度,Pro/Ultra 订阅可获更高配额。
Gemini Omni 1.1 Flash的开源情况与使用局限
Gemini Omni 1.1 Flash 是谷歌推出的闭源商业模型,未开放权重,仅通过 Flow、Gemini API、Vertex AI 与 Google AI Studio 等官方渠道提供调用,不支持自部署。
单次生成以 10 秒为步长从已有片段扩展,单条视频累计最长 40 秒,更长内容需自行拼接多段;按秒计费下长视频成本线性累积,4K 档单价较高。服务依赖可访问 Google 的网络环境,且存在区域可用性限制;Flow 免费档提供每日额度,高并发或长时间生成需订阅 Pro / Ultra 方案。
Gemini Omni 1.1 Flash常见问题
Gemini Omni 1.1 Flash 能生成多长视频?
单次以 10 秒为步长从已有片段尾部扩展,单条视频累计最长可达 40 秒,适合把短素材拉长成完整叙事。
Gemini Omni 1.1 Flash 支持哪些分辨率?
支持 360p、720p、1080p 与 4K;其中 360p 预览模式生成速度最高提升 60%、成本仅三分之一。
Gemini Omni 1.1 Flash 是开源的吗?
不是。它是谷歌推出的闭源商业视频模型,通过 Flow、Gemini API、Vertex AI 与 Google AI Studio 调用,未开放权重。
怎么用 Gemini Omni 1.1 Flash 生成视频?
用 Google 账号登录 Google Flow,选择 Gemini Omni 模型,上传首尾帧或参考视频并设定分辨率,按 10 秒步长扩展至所需时长即可。
Gemini Omni 1.1 Flash 怎么计费?
按秒计费:360p $0.03/秒、720p $0.1/秒、1080p $0.15/秒、4K $0.3/秒;Flow 免费档提供每日额度。
浙公网安备33010202004812号