
谷歌在 8 月 27 日发布 Gemini Omni 1.1 Flash,定位是生产就绪的视频生成模型更新,通过 Gemini API 和 Google AI Studio 面向开发者开放,同时进入 Gemini Enterprise Agent Platform。这次更新集中在四件事:场景扩展(最长累计 40 秒)、首尾关键帧插值、360p 草稿模式、1080p/4K 高清输出,另外给多模态输入加了最多 3 秒的视频参考能力。
这篇按官方博客和定价页把数字拆开看。
定价:四个分辨率档位,全部按秒计费
官方定价表给出了完整对比,Omni 1.1 Flash 与上一代 Omni Flash、Veo 3.1 系列同台:
| 分辨率 | Omni 1.1 Flash | Omni Flash(上一代) | Veo 3.1 Lite | Veo 3.1 Fast |
|---|---|---|---|---|
| 360p | 0.03 美元/秒 | 不支持 | 不支持 | 不支持 |
| 720p | 0.10 美元/秒 | 0.10 美元/秒 | 0.05 美元/秒 | 0.10 美元/秒 |
| 1080p | 0.15 美元/秒 | 不支持 | 0.08 美元/秒 | 0.12 美元/秒 |
| 4K | 0.30 美元/秒 | 不支持 | 不支持 | 0.30 美元/秒 |
两个信息值得展开。其一,上一代 Omni Flash 只有 720p 一个档位,1.1 一次性拉开四档,草稿和成片可以共用同一个模型,不需要在两个工具之间搬运素材。其二,360p 档 0.03 美元/秒是全系最低价,Veo 3.1 Lite 的 720p 都要 0.05 美元/秒。
按 40 秒成片折算:4K 一条 12 美元,1080p 一条 6 美元,360p 草稿一条只要 1.2 美元。官方展示的 Draft Room 工作流是先跑 3 到 4 个 360p 变体、每次只改一个变量、横向对比后锁定方向再上高分辨率,全部走完一轮探索加一条 4K 成片,成本大约在 15 美元上下。

场景扩展:10 秒上下文,40 秒上限
场景扩展指在已有视频的基础上无缝续拍。Omni 1.1 的机制变化在上下文窗口:此前的模型延续视频时只引用最后一秒,1.1 能分析最多 10 秒的前文,官方称这带来了更好的视觉一致性和叙事连贯性,也支持在扩展时转向新的创作方向。
扩展按 10 秒一段接力,累计上限 40 秒。API 形态上每一段通过 previous_interaction_id 串接:
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
previous_interaction_id=previous_video_interaction.id,
input=[{"type": "text", "text": "Continue the scene."}],
response_format={"resolution": "360p"},
)每段可以单独指定分辨率,上面这段就是以 360p 续写。官方示例里演示的续拍指令包括推轨变焦、快速变焦推进、时间冻结加 360 度环绕镜头这类连续镜头控制,扩展段和前文保持在同一个镜头语言体系里。
首尾关键帧:两端点之间的连续生成
指定镜头的起始帧和结束帧,Omni 1.1 生成两帧之间连续过渡的视频。官方给的场景是复杂镜头轨道、变焦转场、无缝循环素材,示例里包括甩镜转场接萨克斯手与芭蕾舞者、镜头推入电视屏幕后回到开场同一场景这类一镜到底的处理。
对搭建创意工具的开发者,这个能力意味着转场和运镜可以作为端点条件来指定,中间的连续画面由模型补全,适合做分镜工具、 looping 素材生成器这类产品形态。
360p 草稿:快 60%,成本三分之一
360p 草稿模式的官方数据是生成速度最多快 60%(按 360p 与 720p 的系统吞吐量对比),价格为 720p 档的三分之一。定位是快速原型、分镜迭代和平台侧的快速渲染。
这个档位和 4K 档组合起来,构成一个完整的成本分层:探索阶段低成本高并发,成片阶段单次高投入。对成本敏感的应用场景(电商素材批量试错、故事板验证),这是这次更新里实际影响开发决策的部分。
视频参考输入:3 秒定角色
多模态输入中可以附上最多 3 秒的参考视频,用来维持视觉上下文和角色一致性。官方演示是把三个参考视频里的舞蹈动作分别映射到三个卡通角色上,合成到一个场景里连续完成。对比只能靠文字描述角色形象的方式,视频参考把"这个角色长什么样"变成了可直接输入的素材。
生态位:Adobe、Figma、Runway 已接入
官方列出的生产环境客户包括:Adobe 已将 Gemini Omni Flash 集成进 Firefly;Figma Weave 创意总监 Itay Schiff 评价扩展能力与 4K 分辨率让团队从生成视频进入导演视频的阶段;Runway 首席创意官 Jamie Umpherson 提到它与现有工作流(提示词、图片或视频起步再生成编辑)自然衔接;GMI Cloud 强调的是细节经得起推敲,适合教育解说类内容。
消费端同步开放:Google Flow 向全部 Google AI Plus、Pro、Ultra 订阅者提供新能力,场景扩展也进入了 Gemini 应用。
小结
Omni 1.1 Flash 的更新逻辑清晰:把视频生成从单次调用拆成了成本分层的工作流(360p 草稿、720p 标准、1080p/4K 成片),把时长上限推到 40 秒,把镜头控制做成端点条件。对开发者,定价表本身就是产品文档的一部分:0.03 美元/秒的草稿档决定了原型阶段的试错方式,0.30 美元/秒的 4K 档决定了成片阶段的预算口径。
来源:Google 官方博客:Gemini Omni 1.1 Flash lets you build with more control(2026-08-27)