Gemini Omni Flash 1.1
由 Google DeepMind 提供
Google 的视频模型,说一句就改一处。
现在支持 4K 输出,单场景 40 秒。

核心功能
技术规格
Gemini Omni
Google Omni 家族的第二款 Omni Flash
5 种任务
文生视频、图生视频、参考生成、编辑、续写
3 到 10 秒
指单次生成;续写后总长可达 40 秒
最高 4K
360p 与 720p 原生,1080p 和 4K 为放大输出
10 + 3
10 张图片,外加 3 段各不超过 3 秒的短片
原生
台词、音效与配乐在同一次生成中完成
16:9、9:16
横版与竖版在每个分辨率下都能选
SynthID
每条成片都带一道不可见的来源标记
应用场景

打字就能改画面
把片子交给它,再说要改什么:换天气、转成动画风、改写招牌。画面其余部分原样不动。

会说话的角色
台词写进提示词,角色就照着说,口型对得上;声线在此后每一次剪辑和修改里都不变。

参考素材说了算
一张产品图、一张出镜人物照,加上 3 秒的动作参考,合成一条产品还原准确的广告。

场景长到 40 秒
先生成开场那一段,再一次加十秒,接成 40 秒场景,人物、场景和配乐始终是同一套。

讲物理的科普片
重力、流体和碰撞都按真实规律走,Gemini 在科学与历史上的底子让细节站得住。

画面里的字能读
从下方字幕条到店铺招牌,屏幕上的字回来时是能读的,后续一句话还能改写内容。
提示词示例
概览
Gemini Omni Flash 1.1 是 Google DeepMind 多模态视频模型的第二代,也是第一代能把一条镜头养长的版本。单次生成仍然是 3 到 10 秒、自带声音,但 1.1 补上了初代缺的那几个控制项:从 360p 草稿到 4K 交付的分辨率阶梯、真正能引导画面的参考视频、可以指定末帧让两张静图之间自己补出运动,以及把片子续到 40 秒而人物与配乐都不换的能力。
1.1 到底改了什么
初代 Omni Flash 每条片子都出 720p,十秒封顶。1.1 留住了那套快速、可对话的内核,把周围的天花板一层层拆掉。分辨率变成每次生成都能选,360p 用来低成本试错,1080p 或 4K 放大留给要交付的那一条。参考输入扩到 10 张图片加 3 段短片,每一份在提示词里各领一个角色。成片也不再是终点:续写会读取末尾那段素材接着往下走,一次十秒,最长到初始长度的四倍。
能对话地改,而不是重新抽卡
多数视频模型把提示词当成一次拉杆。Omni Flash 把它当成一段对话里的第一句。模型在多轮之间记着这个场景,所以“外套换成红色”“镜头跟着她转身继续往下走”“招牌改成 CLOSED”这几句会依次落在同一条片子上,面孔、服装和声线都还在。指令短、一次只改一处最见效;没被提到的部分,就是不会动的部分。
Gemini Omni Flash 1.1 与 Morphic
在 Morphic 上,Gemini Omni 和 Veo 3.1、Seedance 2.5、Kling 一起排在视频模型选单里。把镜头连同声音写成一份简报,需要保持一致的元素配上参考图,然后生成;成片落到 Canvas 上,同一份简报还能换个模型再跑一次,两条结果并排看。中文创作者挑视频模型,习惯先把各家版本横着比一遍再决定;在同一块 Canvas 上一站式地比,比来回切工具省事得多。定下来之后继续在后续对话里改,一次一处,场景的上下文会一直跟着走。
简单定价
今天就免费开始,随时可以升级或取消。
Basic
1100 每月 信用
1 个用户
所有模型
工作流
Standard
3625 每月 信用
1 个用户
所有模型
工作流
Pro
6350 共享 每月 信用
1 用户
所有模型
工作流
Pro Max
24650 共享 每月 信用
1 用户
所有模型
工作流
Enterprise
更高的限制
自定义
定价和账单条款

Free
供随意体验
$0
永久免费