Gemini 3.1 Flash TTS
oleh Google DeepMind
Text‑to‑speech paling ekspresif dari Google, dengan tag audio dan dialog multi‑penutur.

Fitur utama
Spesifikasi teknis
Multibahasa
Kontrol gaya, tempo, dan aksen di banyak bahasa
Hingga 2
Dua suara khas dalam satu generasi multi-penutur
Tag audio
Instruksi bahasa alami plus cue inline dalam kurung siku
SynthID
Watermark asal AI yang tak kasatmata pada output
Contoh penggunaan
Narasi video & voice-over
Tambahkan narasi alami ke video AI atau live-action, dengan nada dan tempo yang diatur dalam bahasa sehari-hari.
Dialog karakter
Suarakan adegan dua penutur untuk video pendek, game, dan explainer, tiap karakter dengan suaranya sendiri.
Voice-over multibahasa
Narasikan naskah yang sama dalam banyak bahasa dengan tempo dan aksen yang terasa natural di tiap bahasa.
Audiobook & konten panjang
Jaga penyampaian tetap alami dan konsisten sepanjang narasi yang panjang.
Explainer & tutorial
Narasi yang jelas dan terarahkan untuk walkthrough produk, materi belajar, dan tutorial cara membuat.
Ad read & promo
Voice read yang ekspresif dan sesuai brand, dengan energi dan penekanan sesuai arahan Anda.
Contoh prompt
Narasi hangat
Ucapkan ini dengan hangat dan pelan, seperti menenangkan seorang anak: Badainya sudah reda. Kamu aman sekarang.
Edit promptAdegan dua penutur
Maya: Sudah dapat kabar soal pekerjaan itu? Tom: Sudah. Aku mulai Senin.
Edit promptIkhtisar
Gemini 3.1 Flash TTS adalah model text-to-speech dari Google, diumumkan pada 15 April 2026 dan terintegrasi di Morphic sebagai model audio untuk Speech. Model ini mengubah teks jadi narasi ekspresif dan alami yang Anda arahkan lewat instruksi bahasa sehari-hari dan tag audio inline, menyuarakan dialog multi-penutur, dan membubuhkan watermark SynthID di setiap klip.
Apa yang membedakan Gemini 3.1 Flash TTS
Kebanyakan text-to-speech membacakan kata-kata Anda dengan gaya penyampaian yang tetap. Gemini 3.1 Flash TTS menerima arahan. Tulis instruksi dalam bahasa sehari-hari sebelum sebuah baris untuk menentukan nada, tempo, atau aksen, lalu sisipkan cue dalam tanda kurung siku, seperti [laughs] atau [whispering], persis di titik yang Anda inginkan. Model ini memerankan arahan tersebut alih-alih membacakannya, sehingga satu naskah bisa berpindah dari bisikan pelan ke penyampaian penuh energi.
Gemini 3.1 Flash TTS di Morphic
Di Morphic, Gemini 3.1 Flash TTS berada di daftar pilihan model audio untuk Speech, berdampingan dengan ElevenLabs. Alihkan prompt bar ke Audio, pilih Speech, pilih Gemini 3.1 Flash TTS, lalu tulis naskah Anda dengan arahan atau tag apa pun, pilih suara dan bahasa, dan buat generasinya. Audionya langsung masuk ke Canvas berdampingan dengan klip video Anda.
Harga sederhana
Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.
Basic
1100 bulanan kredit
1 pengguna saja
Semua model
Workflows
Standard
3625 bulanan kredit
1 pengguna saja
Semua model
Workflows
Pro
6350 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Pro Max
24650 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Enterprise
Untuk batas yang lebih tinggi
Khusus
ketentuan harga dan penagihan

Free
Untuk bereksperimen
$0
gratis selamanya
FAQ
ChatGPT Images 2.5
OpenAI
Model gambar OpenAI, rilis September 2026. Detail lebih tajam, edit presisi, proses lebih cepat.
Lyria 3.5
Google DeepMind
Model musik terbaik dari Google. Lagu utuh: struktur, vokal, dan lirik.
MiniMax H3 Max Turbo
fal.ai
Tingkat cepat dari H3 racikan fal. Dua kali lebih gesit, tampilan mirip.
Inworld TTS 2
Inworld
95 suara, lebih dari 100 bahasa. Audio mulai di bawah satu detik.