音声生成
利用可能

ElevenLabs

ElevenLabs 提供

6つの音声モードを1か所に。
声、音楽、音響、会話、そして音声変換。

ElevenLabs

主な機能

サウンドの幅を聴く

ドキュメンタリーの語り音声

温かく、急がないドキュメンタリー調の読み。

0:00
0:12
歌入りの楽曲音楽

書いた歌詞を、インディーフォークに乗せて歌唱。

0:00
0:12
夜更けの環境音効果音

虫の声、遠くの犬、通り過ぎる車が1台。

0:00
0:12
2人の場面会話

話者2人、別々の声を一度の生成で。

0:00
0:12

技術仕様

6

音声、音楽、効果音、会話、音声変換、文字起こし

3,000文字

テキスト読み上げ1回あたり

5秒〜5分

インストゥルメンタル、または歌詞を歌唱

0.5〜22秒

生成1回あたり

5,000文字

全話者を一度に生成

最大5分

1回の変換で扱えるソース音声

活用事例

話し声の波形のように、光の帯が膨らんでは細くなる

ナレーションと声入れ

AI映像でも実写でも、性別・年齢・訛り・用途から声を選んでナレーションを付けられます。

打ち鳴らされた和音のように広がる、金色の同心円の弧

オリジナル曲と劇伴

インスト曲で映像に劇伴を付けるか、歌詞を書いて指定した作風で歌わせることもできます。

ひとつの明るい衝撃点から放射状に伸びる、発光する細い糸

音響デザインと環境音

フォーリー、室内音、天候の音をライセンス不要で用意し、必要な長さちょうどに設定。

琥珀色と石板色、2本の光の帯が編み合わさる

ポッドキャストと音声劇

イントロ、ナレーション、複数話者の場面まで、登場人物ごとに声と話し方を変えて制作。

暖かな光の糸が1本、暗がりの奥へと遠ざかっていく

オーディオブック

章をまたいでも一定のテンポと声色を保ち、章ごとに演出を指定して生成できます。

1本の光の帯が、暖かな琥珀色から冷たい銀色へと渡っていく

吹き替えと文字起こし

録り直しなしで声を差し替え、どのクリップも話者付きの文字起こしにできます。

プロンプト例

ナレーション

温かいドキュメンタリー調で「潮は一度も遅れたことがない」

0:00
0:12
Edit prompt

歌入りの楽曲

ゆったりしたインディーフォーク。ブラシドラム、女性ボーカル1本で歌詞を歌う

0:00
0:12
Edit prompt

音響デザイン

重い樫の扉が石床を擦って開く。軋む蝶番。8秒

0:00
0:12
Edit prompt

環境音

夜更け。虫の声、遠くの犬、遠ざかる車が1台。20秒

0:00
0:12
Edit prompt

2人の掛け合い

アナ(平坦に)「9時って言ったよね」テオ(早口)「橋が閉鎖、走った」

0:00
0:12
Edit prompt

キャラクター読み

灯台守、しわがれて情の深い声で「40の冬、この灯だ」

0:00
0:12
Edit prompt

概要

ElevenLabsはMorphicの音声まわりを丸ごと担っています。音声、音楽、効果音、会話、ボイスチェンジャー、そしてScribeの文字起こしという6つのモードがこのモデルで動きます。この幅こそが要点です。ひとつの映像には、たいていナレーターと音楽のベッド、いくつかの効果音、ときには相手役の声が要りますが、その全部が同じプロジェクトの中で、素材と並んで揃います。

ふつうのテキスト読み上げと分かれるのは、手元にあるつまみの多さです。安定度、スタイル、類似度、速度があることで、生成は運任せではなく演出になります。音楽はこちらが書いた歌詞をそのまま歌います。効果音は長さを指定できるので、狙ったフレームにぴたりと音が当たります。そして音声変換があるおかげで、すでに録ってある芝居を残したまま、別の声を載せられます。

シンプルな料金体系

今すぐ無料で始めて、いつでもアップグレードまたはキャンセルできます。

Basic

$9/
請求額は $0

1100 月 クレジット

1 ユーザーのみ

すべてのモデル

ワークフロー

Standard

$24/
請求額は $0

3625 月 クレジット

1 ユーザーのみ

すべてのモデル

ワークフロー

Pro

$45/
請求額は $0

6350 共有 月 クレジット

1 ユーザー

+ 最大 4 名まで追加費用

すべてのモデル

ワークフロー

Pro Max

$170/
請求額は $0

24650 共有 月 クレジット

1 ユーザー

+ 最大 9 名まで追加費用

すべてのモデル

ワークフロー

Enterprise

より高い制限のために

カスタム

料金と請求条件

大容量クレジット
カスタムシート制限
すべてのモデル
ワークフロー
Pricing Gradient

Free

気軽に試したい方に

$0

ずっと無料

最大20クレジット
1ユーザーのみ
一部のモデル
ワークフロー

よくある質問

MorphicのElevenLabsとは何ですか。
Morphicの音声モードのうち6つがElevenLabsで動いています。テキストから音声、テキストから音楽、テキストから効果音、テキストから会話、音声から音声への変換(ボイスチェンジャー)、そしてScribeによる文字起こしです。画像や動画と同じワークスペースで音声を作れるため、書き出して読み込み直す手間がありません。
ElevenLabsではどんな音が作れますか。
ナレーションや語りの声、インストにも歌入りにもできるオリジナル楽曲、効果音と環境音、複数話者の会話シーン、そして手元の録音を別の声に変換したものです。Scribeは逆方向にも働き、音声や動画を話者ラベル付きの文字起こしに変えます。
ElevenLabsの声の演技は指定できますか。
できます。テキスト読み上げでは安定度、スタイル、類似度、速度を毎回指定します。安定度は一貫性と表現力のどちらを取るかの調整、スタイルは中庸からどこまで離れた読みにするかの調整、類似度は選んだ声にどれだけ寄せるかの調整、速度はテンポの調整です。会話の生成にも専用の安定度があります。
ElevenLabsの音楽に歌詞とボーカルを入れられますか。
入れられます。音楽ツールにはボーカルの切り替えと歌詞の入力欄があります。自分の歌詞を貼ればモデルがそれを歌い、空欄のままにすれば歌詞ごと書いてくれます。長さは5秒〜5分なので、短いスティングからフルサイズの1曲まで同じツールで足ります。
ボイスチェンジャーは何をするものですか。
音声から音声への変換は、録音した芝居の間や抑揚、感情をそのまま残したまま、別の声で演じ直します。1回の変換で最大5分のソース音声を受け付け、英語にも多言語にも使えます。あくまで声を差し替える変換であって、特定の人物の声を保存して使い回す仕組みではありません。
ElevenLabsの音声はどれくらいの長さまで作れますか。
楽曲は5秒〜5分、効果音は0.5秒〜22秒です。読み上げは時間ではなくプロンプトの長さで決まり、1回あたり3,000文字まで、会話の台本は5,000文字までです。それより長い作品は分けて生成し、つなぎ合わせて仕上げます。
MorphicのAI動画とはどう組み合わせますか。
ナレーション、劇伴、音響デザインをElevenLabsで作り、Morphicのどの動画モデルで生成したクリップとも並べてCanvasに持ち込めます。音と絵が同じプロジェクトにあるので、ワークスペースを離れずに1本の映像へ音楽と語りを付けられます。