AI 模型
on Morphic
探索 Morphic 上所有可用的 AI 模型,从图像和视频生成到音频制作和画质增强。
ChatGPT Images 2.5
OpenAI
ChatGPT Images 2.5 是 OpenAI 在 2026 年 9 月 8 日发布的图像模型。细节更锐利,改一处不动全局,参考图里的人和产品照样认得出,生成速度最高快一倍。API 里提供 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst 两款模型。
Lyria 3.5
Google DeepMind
Google DeepMind 的音乐生成模型:写得出有主歌、副歌和桥段的完整歌曲,人声带表情,歌词您写或者它写,输出 44.1 kHz 立体声,还能按秒安排。
MiniMax H3 Max Turbo
fal.ai
MiniMax H3 Max Turbo 是 fal 从 H3 Max 蒸馏出来的快速档。片子还没播完,渲染就结束了,而提示词还原度、画面质感和原生立体声基本都留了下来。
Inworld TTS 2
Inworld
Inworld 的 Realtime TTS-2 已上线 Morphic。第一声不到一秒就出来,95 个现成音色,一个音色跨 100 多种语言不换人。
Gemini Omni Flash 1.1
Google DeepMind
Gemini Omni Flash 1.1 是 Google DeepMind 的多模态视频模型:画面与声音一次生成,改片只要再说一句。支持 10 张图片加 3 段视频参考,单段 3 到 10 秒可续写到 40 秒,最高输出 4K。
MiniMax H3 Max
fal.ai
MiniMax H3 Max是fal基于MiniMax公开的H3权重后训练出来的版本,更贴合提示词,画面也更耐看,并且重建了推理链路,让768p视频几乎即时返回,还自带原生立体声。
Runway Ruby
Runway
Runway 的 SDR 转 HDR 视频模型。保色提亮,成片抬进16位 EXR 帧序列、ProRes 母版和10位 HDR10 文件。底下的画面一帧都不用重新渲染。
Hyperion 2.5
Topaz Labs
Topaz Labs 出的 SDR 转 HDR 视频模型。8位素材进去,出来的是10位 ProRes 或16位 EXR 母版,逆向色调映射全自动完成,没有一个参数要调。
模型指南
针对特定模型的教程、比较和讲解。
ByteDance Bernini:AI 视频编辑与提示词完整指南
开源 AI 视频模型 ByteDance Bernini 的完整指南:功能、规格、一致性锁定,以及按任务划分的提示词结构。
ChatGPT Images 2.5 使用指南:提示词、编辑与两个模型
ChatGPT Images 2.5(GPT Image 2.5):提示词结构、画面文字、精准编辑、透明底抠图、画质档位,以及 Flare 和 Sunburst 的选法。
ChatGPT Images 2.0 在电商、营销和品牌建设中的应用场景
ChatGPT Images 2.0 应用场景的实用指南。了解如何用 GPT Image 2 创建产品视觉、多语言营销内容、品牌素材等。
Flux 3 完整指南:功能、提示词写法与原生音频视频
Flux 3 完整指南:四种提示词写法、CASTLE 六要素、音频方向、关键帧与片段续接。
Gemini Omni Flash 1.1 使用指南:提示词、改片与新功能
Gemini Omni Flash 1.1 完整指南:五种任务、提示词写法、参考标记、打字改片、40 秒续写与声音指挥,附示例。
Gemini Omni Flash:完整指南、Prompt与功能
Morphic上的Gemini Omni Flash完整指南:功能、原生音频、对话式编辑、角色一致性,以及附带示例的Prompt写法。
Grok Imagine Image 2.0 使用指南:功能、提示词与精准编辑
Grok Imagine Image 2.0 完整指南:文字排版规划、魔术棒区域编辑、多参考图生成与 Smart Resize,附提示词示例。
Grok Imagine Video 1.5 完整指南:提示词与功能
Morphic 上的 Grok Imagine Video 1.5 完整指南:原生同步音频、提示词写法、功能与使用场景,以及技术规格。