AI 模型
on Morphic
探索 Morphic 上所有可用的 AI 模型,从图像和视频生成到音频制作和画质增强。
Flux 3 Image
Black Forest Labs
Black Forest Labs 推出的控制优先图像模型。用边界框摆放每个元素,改一处而其余不动,最多合并 10 张参考图,最高渲染 4K。
Ideogram 4.5
Ideogram
Ideogram 推出的精准编辑模型。同一张图连改多轮,不出现像素偏移、色差和伪影。支持蒙版、最多 4 张参考图和原生 2K 输出。
ChatGPT Images 2.5
OpenAI
ChatGPT Images 2.5 是 OpenAI 在 2026 年 9 月 8 日发布的图像模型。细节更锐利,改一处不动全局,参考图里的人和产品照样认得出,生成速度最高快一倍。API 里提供 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst 两款模型。
Lyria 3.5
Google DeepMind
Google DeepMind 的音乐生成模型:写得出有主歌、副歌和桥段的完整歌曲,人声带表情,歌词您写或者它写,输出 44.1 kHz 立体声,还能按秒安排。
MiniMax H3 Max Turbo
fal.ai
MiniMax H3 Max Turbo 是 fal 从 H3 Max 蒸馏出来的快速档。片子还没播完,渲染就结束了,而提示词还原度、画面质感和原生立体声基本都留了下来。
Inworld TTS 2
Inworld
Inworld 的 Realtime TTS-2 已上线 Morphic。第一声不到一秒就出来,95 个现成音色,一个音色跨 100 多种语言不换人。
Gemini Omni Flash 1.1
Google DeepMind
Gemini Omni Flash 1.1 是 Google DeepMind 的多模态视频模型:画面与声音一次生成,改片只要再说一句。支持 10 张图片加 3 段视频参考,单段 3 到 10 秒可续写到 40 秒,最高输出 4K。
MiniMax H3 Max
fal.ai
MiniMax H3 Max是fal基于MiniMax公开的H3权重后训练出来的版本,更贴合提示词,画面也更耐看,并且重建了推理链路,让768p视频几乎即时返回,还自带原生立体声。
模型指南
针对特定模型的教程、比较和讲解。
ByteDance Bernini:AI 视频编辑与提示词完整指南
开源 AI 视频模型 ByteDance Bernini 的完整指南:功能、规格、一致性锁定,以及按任务划分的提示词结构。
ChatGPT Images 2.5 使用指南:提示词、编辑与两个模型
ChatGPT Images 2.5(GPT Image 2.5):提示词结构、画面文字、精准编辑、透明底抠图、画质档位,以及 Flare 和 Sunburst 的选法。
ChatGPT Images 2.0 在电商、营销和品牌建设中的应用场景
ChatGPT Images 2.0 应用场景的实用指南。了解如何用 GPT Image 2 创建产品视觉、多语言营销内容、品牌素材等。
Flux 3 完整指南:功能、提示词写法与原生音频视频
Flux 3 完整指南:四种提示词写法、CASTLE 六要素、音频方向、关键帧与片段续接。
Flux 3 Image 完整指南:提示词、边界框与改图
Flux 3 Image 怎么用:提示词、边界框版面、改图指令、多参考图合并、逐框编辑与 4K 输出。
Gemini Omni Flash 1.1 使用指南:提示词、改片与新功能
Gemini Omni Flash 1.1 完整指南:五种任务、提示词写法、参考标记、打字改片、40 秒续写与声音指挥,附示例。
Gemini Omni Flash:完整指南、Prompt与功能
Morphic上的Gemini Omni Flash完整指南:功能、原生音频、对话式编辑、角色一致性,以及附带示例的Prompt写法。
Grok Imagine Image 2.0 使用指南:功能、提示词与精准编辑
Grok Imagine Image 2.0 完整指南:文字排版规划、魔术棒区域编辑、多参考图生成与 Smart Resize,附提示词示例。