Gemini Omni Flash 1.1 AI视频生成器

Google 更新后的视频模型。 把镜头打出来,再指挥它。

所有视频模型

同一个工作台

用 Gemini Omni Flash 1.1 生成

核心功能

Gemini Omni Flash 1.1 能生成什么

一句话,画面连声音一起来

把镜头和声音写在一起,两样一次都回来:动作、环境底噪、角色说的那句台词,口型对得上。您点名的声音,就是您听到的声音。

夜里忙碌的拉面厨房,蒸汽穿过吊灯升起,厨师正在装碗

打字就能改画面

先生成,再指挥:重新布光、换掉外套、改写招牌。每条指令都落在同一条成片上,没提到的部分原样不动。

同一位男子站在雨中石桥上的分屏画面,左边是炭灰大衣,右边是黄色雨衣

场景一路长到 40 秒

先来十秒开场,再以十秒为步长往下接。模型读您末尾那几帧,把动作、人物和配乐接着往下走,接口看起来像一镜到底。

一列红色火车在黄昏时分驶过石砌高架桥,开向亮着灯的村庄,四格连拍

角色和产品还原得准

最多 10 张图片加 3 段短片,钉住画面里出现的人和物。一个角色的面孔、衣着和声线,从第一次生成一直守到最后一次修改。

一块手表和一位模特的参考卡片,钉在深色亚麻布上的成片广告画面旁

三步生成一条视频

  1. 01

    打开 Morphic

    注册之后,在一块可以随意铺开的无限画布上开始生成。

  2. 02

    把镜头连声音一起写出来

    主体、动作、镜头、光线,还有声音。交代什么时候发生什么,以及这段是一镜到底还是要切。

  3. 03

    生成,然后指挥

    在后续对话里打磨:一轮只改一处;场景不够用时,再往后续写。

全都在 Morphic 上

一站式视频生产

简单定价

今天就免费开始,随时可以升级或取消。

Basic

$9/
账单金额为 $0 每年

1100 每月 信用

1 个用户

所有模型

工作流

Standard

$24/
账单金额为 $0 每年

3625 每月 信用

1 个用户

所有模型

工作流

Pro

$45/
账单金额为 $0 每年

6350 共享 每月 信用

1 用户

+ 最多 4 人额外付费可增加

所有模型

工作流

Pro Max

$170/
账单金额为 $0 每年

24650 共享 每月 信用

1 用户

+ 最多 9 人额外付费可增加

所有模型

工作流

Enterprise

更高的限制

自定义

定价和账单条款

大容量信用
自定义席位限制
所有模型
工作流
Pricing Gradient

Free

供随意体验

$0

永久免费

最多 20 积分
仅1个用户
部分模型
工作流

常见问题

现在就能用上 Gemini Omni Flash 1.1 的 AI视频生成器吗?
能。把镜头写进上面的提示词框生成即可,全程在浏览器里跑,什么都不用装。Morphic 把 Gemini Omni 和 Veo 3.1、Seedance 2.5、Kling 以及整个视频模型库放在一起,同一份简报可以交给好几个模型,结果并排落在 Canvas 上比。
Gemini Omni Flash 1.1 是什么?
Google DeepMind 多模态视频模型的第二代,2026 年 8 月下旬上线。它从文字、图片和参考视频生成 3 到 10 秒、自带声音的片子,然后继续在这条片子上干活:后续提示词修改同一条成片,续写把它接到 40 秒。1.1 这一代补上了最高到 4K 的分辨率阶梯、真正生效的参考视频,以及首帧到末帧的插值。
它和普通的文生视频工具差在哪?
生成过程是一段对话,不是一次性渲染。第一条成片出来之后,用大白话说要改什么,模型照着改,画面其余部分维持原样:面孔、服装和声线一轮轮都还在。普通生成器只能整条重抽再碰运气;这一个让您留住镜头,只修那处细节。
Gemini Omni Flash 1.1 视频生成器带声音吗?
带,声音和画面在同一次生成里出来:带口型的台词、音效、环境声,还有跟着动作走的配乐。声音要像写画面一样写进简报,因为提示词里对声音只字不提时,模型会自己挑一条配乐。连安静也得开口要。
生成出来的视频能有多长?
单次生成 3 到 10 秒。之后用续写一次接十秒,总长最多 40 秒;模型读取末尾那段素材,让动作、人物和声音在接口处连着。短镜头就这样长成一场完整的戏,不必手动拼接。
Gemini Omni Flash 1.1 能出多高的分辨率?
四档,横版 16:9 或竖版 9:16 都行:360p 用来低成本打草稿,720p 原生渲染,1080p 和 4K 由这次生成结果放大而来。实际做法是先用低分辨率反复调,镜头对了再要一次交付分辨率,而不是每次尝试都按 4K 算。
能用我自己的图片和素材吗?
可以。让一张静图动起来,给出首帧和尾帧让它在两者之间补出运动,或者挂上最多 10 张参考图片和 3 段短片,钉住角色、产品、场景或风格。同一张图既当首帧又当尾帧,回来就是一条接得上的循环。
做中文内容时,画面里的字和提示词该怎么处理?
分两件事。提示词用英文写,Google 只对英文提示词做了完整评估;中文脚本照常写,落到提示词框那一步再换成英文的镜头说明,把画面、声音和时间点交代齐就行。画面里要出现的文字也留英文,中文和日文字形会被画成像模像样的错字,非要放中文就得逐帧核对。中文字幕更稳的做法是先出片,再在剪辑里压字。竖版 9:16 是原生支持的比例,短视频平台可以直接用。

你可能也喜欢