Gemini 3.1 Flash TTS
por Google DeepMind
O texto para voz mais expressivo do Google, com tags de áudio e diálogo com múltiplos falantes.

Principais recursos
Especificações técnicas
Multilingual
Controle de estilo, ritmo e sotaque em vários idiomas
Up to 2
Duas vozes distintas em uma geração com múltiplos falantes
Audio tags
Notas em linguagem natural somadas a sinais entre colchetes
SynthID
Marca d'água imperceptível de proveniência de IA na saída
Casos de uso
Narração e locução de vídeo
Adicione narração natural a vídeos com IA ou filmados, com tom e ritmo definidos em linguagem comum.
Diálogo de personagens
Dê voz a cenas com dois personagens para curtas, jogos e vídeos explicativos, cada personagem com sua própria voz.
Locução localizada
Narre o mesmo roteiro em vários idiomas, com ritmo e sotaque nativos em cada um.
Audiobook e conteúdo longo
Mantenha a entrega natural e consistente em passagens longas de narração.
Explicações e tutoriais
Narração clara e direcionável para demonstrações de produto, aulas e passo a passo.
Anúncios e promoções
Leituras de voz expressivas e alinhadas à marca, com a energia e a ênfase que você direcionar.
Exemplos de prompts
Narração calorosa
Say this warmly and slowly, like comforting a child: The storm has passed. You're safe now.
Edit promptDe sussurro a voz normal
[whispering] Don't make a sound. [normal voice] Okay, we're clear.
Edit promptPreços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
900 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3200 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6200 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24000 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
Seedance 2.5
ByteDance
O novo modelo de vídeo de próxima geração da ByteDance. Até 30s de clipes nativos, 50 referências, áudio nativo.
Kling 4.0
Kling
Próximo carro-chefe da Kling, esperado em breve. Clipes mais longos e mais nitidez estão a caminho.
MiniMax H3
MiniMax
O modelo de vídeo multimodal da MiniMax. 2K, áudio estéreo nativo, clipes de até 15s.
Flux 3
Black Forest Labs
O world model da Black Forest Labs para imagem, vídeo e áudio, com som que combina com a ação.