Gemini 3.1 Flash TTS
oleh Google DeepMind
Text‑to‑speech paling ekspresif dari Google, dengan tag audio dan dialog multi‑penutur.

Fitur utama
Spesifikasi teknis
Multibahasa
Kontrol gaya, tempo, dan aksen di banyak bahasa
Hingga 2
Dua suara khas dalam satu generasi multi-penutur
Tag audio
Instruksi bahasa alami plus cue inline dalam kurung siku
SynthID
Watermark asal AI yang tak kasatmata pada output
Contoh penggunaan
Narasi video & voice-over
Tambahkan narasi alami ke video AI atau live-action, dengan nada dan tempo yang diatur dalam bahasa sehari-hari.
Dialog karakter
Suarakan adegan dua penutur untuk video pendek, game, dan explainer, tiap karakter dengan suaranya sendiri.
Voice-over multibahasa
Narasikan naskah yang sama dalam banyak bahasa dengan tempo dan aksen yang terasa natural di tiap bahasa.
Audiobook & konten panjang
Jaga penyampaian tetap alami dan konsisten sepanjang narasi yang panjang.
Explainer & tutorial
Narasi yang jelas dan terarahkan untuk walkthrough produk, materi belajar, dan tutorial cara membuat.
Ad read & promo
Voice read yang ekspresif dan sesuai brand, dengan energi dan penekanan sesuai arahan Anda.
Contoh prompt
Narasi hangat
Ucapkan ini dengan hangat dan pelan, seperti menenangkan seorang anak: Badainya sudah reda. Kamu aman sekarang.
Edit promptAdegan dua penutur
Maya: Sudah dapat kabar soal pekerjaan itu? Tom: Sudah. Aku mulai Senin.
Edit promptHarga sederhana
Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.
Basic
900 bulanan kredit
1 pengguna saja
Semua model
Workflows
Standard
3200 bulanan kredit
1 pengguna saja
Semua model
Workflows
Pro
6200 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Pro Max
24000 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Enterprise
Untuk batas yang lebih tinggi
Khusus
ketentuan harga dan penagihan

Free
Untuk bereksperimen
$0
gratis selamanya
FAQ
Seedance 2.5
ByteDance
Model video generasi berikutnya dari ByteDance. Hingga 30 detik klip native, 50 referensi, audio native.
Kling 4.0
Kling
Flagship Kling berikutnya dari Kuaishou, segera hadir. Klip lebih panjang dan detail lebih tajam siap meluncur.
MiniMax H3
MiniMax
Model video multimodal dari MiniMax. 2K, audio stereo native, klip hingga 15 detik.
Flux 3
Black Forest Labs
World model dari Black Forest Labs untuk gambar, video, dan audio, dengan suara yang sesuai dengan aksinya.