Pembuatan audio
Tersedia sekarang

Gemini 3.1 Flash TTS

oleh Google DeepMind

Text‑to‑speech paling ekspresif dari Google, dengan tag audio dan dialog multi‑penutur.

Gemini 3.1 Flash TTS

Fitur utama

Spesifikasi teknis

Multibahasa

Kontrol gaya, tempo, dan aksen di banyak bahasa

Hingga 2

Dua suara khas dalam satu generasi multi-penutur

Tag audio

Instruksi bahasa alami plus cue inline dalam kurung siku

SynthID

Watermark asal AI yang tak kasatmata pada output

Contoh penggunaan

Narasi video & voice-over

Tambahkan narasi alami ke video AI atau live-action, dengan nada dan tempo yang diatur dalam bahasa sehari-hari.

Dialog karakter

Suarakan adegan dua penutur untuk video pendek, game, dan explainer, tiap karakter dengan suaranya sendiri.

Voice-over multibahasa

Narasikan naskah yang sama dalam banyak bahasa dengan tempo dan aksen yang terasa natural di tiap bahasa.

Audiobook & konten panjang

Jaga penyampaian tetap alami dan konsisten sepanjang narasi yang panjang.

Explainer & tutorial

Narasi yang jelas dan terarahkan untuk walkthrough produk, materi belajar, dan tutorial cara membuat.

Ad read & promo

Voice read yang ekspresif dan sesuai brand, dengan energi dan penekanan sesuai arahan Anda.

Contoh prompt

Narasi hangat

Ucapkan ini dengan hangat dan pelan, seperti menenangkan seorang anak: Badainya sudah reda. Kamu aman sekarang.

Edit prompt

Reaksi inline

Aku enggak percaya kamu melakukan itu [laughs]. Kejutan terbaik tahun ini.

Edit prompt

Bisikan ke normal

[whispering] Jangan bersuara. [normal voice] Oke, sudah aman.

Edit prompt

Kontrol aksen

Bacakan ini dengan aksen Inggris: Cuaca yang indah ya hari ini?

Edit prompt

Tempo dramatis

Bacakan ini pelan-pelan dan penuh penekanan: Setiap. Kata. Berarti.

Edit prompt

Adegan dua penutur

Maya: Sudah dapat kabar soal pekerjaan itu? Tom: Sudah. Aku mulai Senin.

Edit prompt

Harga sederhana

Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.

Basic

$9/ bulan
ditagih sebagai $0 per tahun

900 bulanan kredit

1 pengguna saja

Semua model

Workflows

Standard

$24/ bulan
ditagih sebagai $0 per tahun

3200 bulanan kredit

1 pengguna saja

Semua model

Workflows

Pro

$45/ bulan
ditagih sebagai $0 per tahun

6200 bersama bulanan kredit

1 pengguna

+ hingga 4 lainnya dengan biaya tambahan

Semua model

Workflows

Pro Max

$170/ bulan
ditagih sebagai $0 per tahun

24000 bersama bulanan kredit

1 pengguna

+ hingga 9 lainnya dengan biaya tambahan

Semua model

Workflows

Enterprise

Untuk batas yang lebih tinggi

Khusus

ketentuan harga dan penagihan

Kredit volume tinggi
Batas kursi khusus
Semua model
Workflows
Pricing Gradient

Free

Untuk bereksperimen

$0

gratis selamanya

Hingga 20 kredit
Hanya 1 pengguna
Model terbatas
Workflows

FAQ

Apa itu Gemini 3.1 Flash TTS?
Gemini 3.1 Flash TTS adalah model text-to-speech dari Google, diumumkan pada 15 April 2026. Model ini menghasilkan narasi ekspresif dan alami yang Anda arahkan lewat instruksi bahasa sehari-hari dan tag audio inline, mendukung dialog multi-penutur, dan membubuhkan watermark SynthID di setiap klip.
Apa yang bisa saya buat dengan model ini di Morphic?
Pakai Gemini 3.1 Flash TTS untuk voice-over, narasi, dialog karakter, voice-over multibahasa, dan ad read yang ekspresif. Hasilkan audionya di Morphic, lalu masukkan ke Canvas berdampingan dengan klip video Anda dalam alur kerja yang sama.
Bagaimana cara mengarahkan suaranya?
Ada dua cara, dan Anda bisa menggabungkannya. Tulis instruksi bahasa sehari-hari sebelum baris Anda, misalnya 'Ucapkan ini dengan hangat dan pelan:', dan tambahkan cue inline dalam tanda kurung siku, seperti [laughs] atau [whispering], di titik yang Anda inginkan. Gemini memerankan cue tersebut, bukan membacakannya.
Apakah mendukung banyak penutur?
Ya. Gemini 3.1 Flash TTS bisa menyuarakan percakapan bolak-balik antara dua penutur dalam satu generasi, dengan suara khas untuk masing-masing. Beri label nama penutur di tiap baris dan tetapkan suara untuk masing-masing sebelum Anda melakukan generasi.
Berapa banyak bahasa yang didukung?
Gemini 3.1 Flash TTS bisa menarasikan dalam banyak bahasa, dengan kontrol atas aksen, tempo, dan gaya di tiap bahasa. Pilih suara dan bahasa yang sesuai dengan naskah Anda sebelum melakukan generasi.
Apa bedanya dengan ElevenLabs di Morphic?
Keduanya menghasilkan suara berkualitas manusia di Morphic. ElevenLabs adalah suite audio lengkap yang mencakup ucapan, musik, dan efek suara dengan kontrol penyetelan suara yang mendetail. Gemini 3.1 Flash TTS berfokus pada ucapan yang ekspresif dan terarahkan, dengan arahan bahasa sehari-hari, tag audio inline, dan dialog multi-penutur. Banyak kreator memakai keduanya, satu untuk suara, satu lagi untuk musik dan efek.
Apakah audionya diberi watermark?
Ya. Setiap klip yang dihasilkan Gemini 3.1 Flash TTS membawa watermark SynthID Google yang tak kasatmata untuk melacak asal AI. Watermark ini tidak terdengar oleh pendengar dan dirancang bertahan meski melewati proses umum seperti re-encoding.
Bagaimana cara memakai Gemini 3.1 Flash TTS di Morphic?
Buka Morphic, alihkan prompt bar ke Audio, lalu pilih Speech. Pilih Gemini 3.1 Flash TTS sebagai model audio, tulis naskah Anda dengan arahan atau tag apa pun yang diperlukan, pilih suara dan bahasa, lalu buat generasinya.