#2
Google (Veo and Gemini)
三种模态都有前沿模型,通过 Gemini 和电影制作应用 Flow 使用。
Google 三种模态各有一个顶级模型:图像是 Imagen 和 Nano Banana,视频是 Veo,音乐是 Lyria,都通过 Gemini 助手和专为AI电影制作打造的 Flow 应用来协调使用。视频画质配上同步音频,是它特别突出的地方。这些功能分散在好几个界面里,不是集中在一个创作画布上,最强的档位也需要付费AI订阅。要论单个格式的前沿效果,很难找到能超过它的。
最适合: 三种模态都是前沿水准
- 功能分散在 Gemini、Flow 等多个界面
- 最强档位需要付费AI订阅
聚合平台,一份订阅就能用上一大堆第三方图像视频音频模型。
Freepik 从素材库起家,如今变成一个AI聚合平台,一个账号就能用上一大堆外部的图像、视频、音频模型。它的优势在于覆盖广:不用分别注册和付费,就能并排试用好几家供应商的模型,还保留着原来的素材库。因为聚合的是别家的模型,每一个的深度都取决于原厂商本身的水平,大量生成也要靠额度系统计费。想在一个地方多试几家模型,它能覆盖的范围确实不小。
最适合: 一份订阅覆盖多个模型
- 图像视频音频模型选择面广
- 一个账号一份账单覆盖多家供应商
商用安全的图像视频生成工具,深度嵌进 Creative Cloud 各款编辑软件里。
Firefly 是 Adobe 的生成式引擎,用授权素材和公有领域内容训练,出来的结果定位是商用安全。它能生成图像和视频,还能调用其他供应商的模型,并且直接长在 Photoshop、Premiere 和 Express 里,生成结果能直接接着编辑。音频生成这块比图像视频要弱一些,完整功能也要靠 Creative Cloud 订阅。对已经在用 Adobe 全家桶、又需要有版权保障的团队来说,它正好嵌进现有流程。
最适合: Creative Cloud内的商用安全输出
- 输出结果定位为商用安全
- 深度嵌入Photoshop、Premiere和Express
- 音频能力弱于图像和视频
- 完整功能需要Creative Cloud订阅
以生成为核心的套件,视频模型是主力,图像工具和AI编辑功能也在同一个屋檐下。
Runway 靠 Gen 系列视频模型打响名号,周边配上图像生成和局部重绘、绿幕抠像这类AI编辑功能。这让它成了做电影感和特效向作品的天然选择,生成和编辑都在同一个地方。音频在整体功能里占比较小,最重的功能也锁在付费档。对需要随手就能编辑的视频创作来说,它是最锋利的选项之一。
最适合: 视频为主,编辑工具齐全