Seed Audio 1.0 AI音声ジェネレーター

ByteDance の Seed Audio 1.0。 音声・音楽・効果音を一度に生成。

すべての音声モデル

1つのワークスペースで

Seed Audio 1.0 で作成

ドキュメンタリーのナレーション

音声、温かく落ち着いた語り

スリラーのボイスオーバー

音声、ひそやかで張り詰めた

スパイス市場のアンビエンス

効果音、開放的な屋外のベッド

雷雨

効果音、嵐から雷鳴の一撃へ

オーケストラのキュー

音楽、高まる弦楽と金管

ローファイビート

音楽、柔らかな鍵盤とビニールノイズ

3ステップで音声を生成

  1. 01

    Morphic を開く

    登録して、自由に広がる無限のビジュアルキャンバスで作り始めます。

  2. 02

    シーンを書く

    舞台、配役、音楽と効果音、各人の声、そしてセリフ。最大3,000文字。

  3. 03

    生成して整える

    音声・音楽・効果音がミックス済みで返ります。説明を調整し、Canvas でモデルを切り替え。

Seed Audio 1.0 が生成するもの

シーン全体を一度に

音声・楽曲・効果音がまとめて、そのシーンに合わせた比率でミックスされて返ります。カフェのプロンプトなら、汎用の部屋鳴りではなく周囲のざわめきと正しい音響空間が付きます。

映画的なフィルムスチル: 夕暮れの雨に濡れた通りで傘をさす孤独な人物

オーディオブックと長尺ナレーション

収録なしでナレーション、キャラクターボイス、音響を用意します。語り手を一度決めたら、同じ音声参照のまま1冊をシーンごとに進められます。

温かなキーライトに照らされたスタジオマイクのある居心地の良い自宅の録音スペース

全キャストの対話

1つのシーンに複数の人物を書けば、1回の生成で各人に声・感情・テンポが与えられ、周囲の環境音や効果音も一緒に作られます。

雨の筋がついた窓のそば、小さなカフェのテーブルを挟んで会話中の二人

カットに落ちる吹き替え

各セリフにタイムスタンプを付ければ、演技がその区間ちょうどに収まります。タイムラインからイン点とアウト点を取れば、トラックは伸縮も切り詰めもなしに絵に乗ります。

暗いモニターに光る波形タイムラインが表示された音声編集のワークスペース

Seed Audio プロンプトの構造

4つを挙げれば、モデルに必要なものはそろいます。シーンの場所、話す人、話す言葉、そしていつ収まるべきか。
舞台セリフタイミング
舞台柔らかな台所の環境音、低いオーブンの唸り、穏やかな語り手が、温かく急がずに言うセリフ「小麦粉とバターを混ぜて」タイミング自然なテンポで、急がない
舞台満員のスタジアム、沸き立つ観客、英国なまりの実況が、興奮で少しかすれた声で叫ぶセリフ「おおっと、決めた!なんというゴールだ!」タイミング歓声はその言葉で爆発し、最後まで続く
舞台夜の駅のホーム、アイドリングする列車、若い男性が、温かい声で息を切らして呼びかけるセリフ「マヤ!待って、本当に今夜行ってしまうの?」タイミング[5.5s:8.0s]

すべては Morphic で

音声制作のすべてを1か所に

シンプルな料金体系

今すぐ無料で始めて、いつでもアップグレードまたはキャンセルできます。

Basic

$9/
請求額は $0

900 月 クレジット

1 ユーザーのみ

すべてのモデル

ワークフロー

Standard

$24/
請求額は $0

3200 月 クレジット

1 ユーザーのみ

すべてのモデル

ワークフロー

Pro

$45/
請求額は $0

6200 共有 月 クレジット

1 ユーザー

+ 最大 4 名まで追加費用

すべてのモデル

ワークフロー

Pro Max

$170/
請求額は $0

24000 共有 月 クレジット

1 ユーザー

+ 最大 9 名まで追加費用

すべてのモデル

ワークフロー

Enterprise

より高い制限のために

カスタム

料金と請求条件

大容量クレジット
カスタムシート制限
すべてのモデル
ワークフロー
Pricing Gradient

Free

気軽に試したい方に

$0

ずっと無料

最大20クレジット
1ユーザーのみ
一部のモデル
ワークフロー

よくある質問

Seed Audio 1.0 AI音声ジェネレーターとは何ですか?
Seed Audio 1.0 は ByteDance のオールインワン音声合成モデルです。1つのプロンプトで音声・楽曲・効果音がまとめて返り、自分で組み立てる3つのファイルではなく、ミックス済みの完成トラックになります。部屋、音楽、効果音、各人物の声を書き、続けてセリフを書けば、シーン全体が1回の生成で戻ります。
通常の音声合成ジェネレーターと何が違いますか?
通常の音声合成は声を選んでテキストを読み上げます。Seed Audio 1.0 はテキストから音声へ、さらに参照から音声へと進みます。プロンプトは最大3,000文字でシーン全体を描写し、モデルはそのシーンに合わせた比率で声・環境音・音楽をミックスして返します。
各セリフが入るタイミングを正確に指定できますか?
できます。セリフの先頭に [5.5s:8.0s] のようなタイムスタンプを置けば、モデルが速度と間を調整して、その区間ちょうどに演技を収めます。音を絵に合わせる必要があり、だいたいでは足りない吹き替えで実用的なのはこのためです。
特定の声を得るにはどうすればいいですか?
方法は3つあります。年齢、なまり、感情、声色、話す速さを書いてテキストで指定する。キャラクター画像をアップロードしてモデルに合う声を導かせる。または各30秒までの参照クリップを3本まで渡し、人物に紐づけて、生成される声を録音に従わせる。
Seed Audio 1.0 はどの言語に対応していますか?
20言語で、日本語、英語、中国語、韓国語、スペイン語、フランス語、ドイツ語、ポルトガル語、インドネシア語、トルコ語などが含まれます。話させたいセリフと同じ言語でプロンプトを書くことが、なまりを正しく出すうえで最も効きます。
Seed Audio 1.0 AI音声ジェネレーターはオンラインで使えますか?
使えます。すべて Morphic のブラウザ上で動き、ダウンロードもインストールも不要です。シーンを書いて生成すれば、GPU のないノートパソコンからでもトラックが Canvas に届きます。
Seed Audio 1.0 AI音声ジェネレーターは無料ですか?
Morphic には無料プランがあり、支払いなしですぐに音声を生成できます。より多くの生成量や商用利用には有料プランがあります。

こちらもおすすめ