AI 模型
on Morphic

探索 Morphic 上所有可用的 AI 模型,从图像和视频生成到音频制作和画质增强。

图像

ChatGPT Images 2.5

OpenAI

ChatGPT Images 2.5 是 OpenAI 在 2026 年 9 月 8 日发布的图像模型。细节更锐利,改一处不动全局,参考图里的人和产品照样认得出,生成速度最高快一倍。API 里提供 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst 两款模型。

音频

Lyria 3.5

Google DeepMind

Google DeepMind 的音乐生成模型:写得出有主歌、副歌和桥段的完整歌曲,人声带表情,歌词您写或者它写,输出 44.1 kHz 立体声,还能按秒安排。

视频

MiniMax H3 Max Turbo

fal.ai

MiniMax H3 Max Turbo 是 fal 从 H3 Max 蒸馏出来的快速档。片子还没播完,渲染就结束了,而提示词还原度、画面质感和原生立体声基本都留了下来。

音频

Inworld TTS 2

Inworld

Inworld 的 Realtime TTS-2 已上线 Morphic。第一声不到一秒就出来,95 个现成音色,一个音色跨 100 多种语言不换人。

多模态

Gemini Omni Flash 1.1

Google DeepMind

Gemini Omni Flash 1.1 是 Google DeepMind 的多模态视频模型:画面与声音一次生成,改片只要再说一句。支持 10 张图片加 3 段视频参考,单段 3 到 10 秒可续写到 40 秒,最高输出 4K。

视频

MiniMax H3 Max

fal.ai

MiniMax H3 Max是fal基于MiniMax公开的H3权重后训练出来的版本,更贴合提示词,画面也更耐看,并且重建了推理链路,让768p视频几乎即时返回,还自带原生立体声。

工具

Runway Ruby

Runway

Runway 的 SDR 转 HDR 视频模型。保色提亮,成片抬进16位 EXR 帧序列、ProRes 母版和10位 HDR10 文件。底下的画面一帧都不用重新渲染。

工具

Hyperion 2.5

Topaz Labs

Topaz Labs 出的 SDR 转 HDR 视频模型。8位素材进去,出来的是10位 ProRes 或16位 EXR 母版,逆向色调映射全自动完成,没有一个参数要调。

模型指南

针对特定模型的教程、比较和讲解。

视频

ByteDance Bernini:AI 视频编辑与提示词完整指南

开源 AI 视频模型 ByteDance Bernini 的完整指南:功能、规格、一致性锁定,以及按任务划分的提示词结构。

图像

ChatGPT Images 2.5 使用指南:提示词、编辑与两个模型

ChatGPT Images 2.5(GPT Image 2.5):提示词结构、画面文字、精准编辑、透明底抠图、画质档位,以及 Flare 和 Sunburst 的选法。

图像

ChatGPT Images 2.0 在电商、营销和品牌建设中的应用场景

ChatGPT Images 2.0 应用场景的实用指南。了解如何用 GPT Image 2 创建产品视觉、多语言营销内容、品牌素材等。

视频

Flux 3 完整指南:功能、提示词写法与原生音频视频

Flux 3 完整指南:四种提示词写法、CASTLE 六要素、音频方向、关键帧与片段续接。

视频

Gemini Omni Flash 1.1 使用指南:提示词、改片与新功能

Gemini Omni Flash 1.1 完整指南:五种任务、提示词写法、参考标记、打字改片、40 秒续写与声音指挥,附示例。

视频

Gemini Omni Flash:完整指南、Prompt与功能

Morphic上的Gemini Omni Flash完整指南:功能、原生音频、对话式编辑、角色一致性,以及附带示例的Prompt写法。

图像

Grok Imagine Image 2.0 使用指南:功能、提示词与精准编辑

Grok Imagine Image 2.0 完整指南:文字排版规划、魔术棒区域编辑、多参考图生成与 Smart Resize,附提示词示例。

视频

Grok Imagine Video 1.5 完整指南:提示词与功能

Morphic 上的 Grok Imagine Video 1.5 完整指南:原生同步音频、提示词写法、功能与使用场景,以及技术规格。