Gemini 3.1 Flash TTS
Google DeepMind 提供
Googleで最も表現豊かなテキスト読み上げ。
オーディオタグとマルチスピーカー会話に対応。

主な機能
技術仕様
多言語
多くの言語でスタイル・速度・アクセントを制御
最大2人
1回のマルチスピーカー生成で2つの異なる声
音声タグ
自然な言葉の指示とインラインの角括弧タグ
SynthID
出力に付与される知覚できないAI出所ウォーターマーク
活用事例
動画ナレーションとボイスオーバー
AIや実写の動画に自然なナレーションを追加。トーンや速度は普通の言葉で指定できます。
キャラクターの対話
ショート、ゲーム、解説向けに2人の話者のシーンを声に。各キャラクターに固有の声を割り当てます。
ローカライズされたボイスオーバー
同じ台本を多くの言語で、ネイティブな速度とアクセントでナレーションします。
オーディオブックと長尺コンテンツ
長いナレーションでも自然で一貫した読み上げを維持します。
解説とチュートリアル
製品ウォークスルー、レッスン、ハウツー向けの明瞭で演出可能なナレーション。
広告ナレーションとプロモ
あなたが演出するエネルギーと強調で、表現豊かでブランドに沿った読み上げを。
プロンプト例
概要
Gemini 3.1 Flash TTSはGoogleのテキスト読み上げモデルで、2026年4月15日に発表され、発話向けのオーディオモデルとしてMorphicに統合されています。テキストを、普通の言葉による指示とインラインのオーディオタグで演出できる表現豊かで自然なナレーションに変換し、マルチスピーカー会話を声にし、すべてのクリップにSynthIDウォーターマークを付与します。
Gemini 3.1 Flash TTSの違い
ほとんどのテキスト読み上げは、決まった調子で言葉を読み返すだけです。Gemini 3.1 Flash TTSは演出を受け取ります。ラインの前に普通の言葉で指示を書いてトーン・速度・アクセントを設定し、[laughs] や [whispering] のような角括弧の指示を好きな位置に置きます。モデルは読み上げる代わりに演出を実行するので、1つの台本がひそやかな独白から全力の読み上げまで変化します。
Morphic上のGemini 3.1 Flash TTS
Morphicでは、Gemini 3.1 Flash TTSはSpeech用のオーディオモデルセレクターにElevenLabsと並んで配置されています。プロンプトバーをAudioに切り替えてSpeechを選び、Gemini 3.1 Flash TTSを選択し、演出やタグを入れた台本を書き、声と言語を選んで生成します。音声はそのままCanvasの動画クリップの隣に配置されます。
シンプルな料金体系
今すぐ無料で始めて、いつでもアップグレードまたはキャンセルできます。
Basic
1100 月 クレジット
1 ユーザーのみ
すべてのモデル
ワークフロー
Standard
3625 月 クレジット
1 ユーザーのみ
すべてのモデル
ワークフロー
Pro
6350 共有 月 クレジット
1 ユーザー
すべてのモデル
ワークフロー
Pro Max
24650 共有 月 クレジット
1 ユーザー
すべてのモデル
ワークフロー
Enterprise
より高い制限のために
カスタム
料金と請求条件

Free
気軽に試したい方に
$0
ずっと無料