Gemini 3.1 Flash TTS
von Google DeepMind
Googles ausdrucksstärkstes Text‑to‑Speech‑Modell, mit Audio‑Tags und Mehrsprecher‑Dialogen.

Hauptfunktionen
Technische Spezifikationen
Mehrsprachig
Steuerung von Stil, Tempo und Akzent in vielen Sprachen
Bis zu 2
Zwei unverwechselbare Stimmen in einer Mehrsprecher-Generierung
Audio-Tags
Anweisungen in normaler Sprache plus Hinweise in eckigen Klammern
SynthID
Unhörbares Wasserzeichen zur Kennzeichnung von KI-Inhalten
Anwendungsfälle
Videoerzählung und Voice-over
Verleihen Sie KI- oder Realvideos eine natürliche Erzählstimme, mit Ton und Tempo in normaler Sprache festgelegt.
Charakterdialoge
Vertonen Sie Zweier-Szenen für Kurzfilme, Games und Erklärvideos, jede Figur mit eigener Stimme.
Lokalisierte Vertonung
Erzählen Sie dasselbe Skript in vielen Sprachen mit nativer Betonung und Akzentsteuerung, inklusive deutscher Stimmen.
Hörbücher und Langform-Inhalte
Halten Sie die Wiedergabe über lange Erzählpassagen hinweg natürlich und konsistent.
Erklärvideos und Tutorials
Klare, steuerbare Erzählung für Produkt-Walkthroughs, Schulungen und Anleitungen.
Werbespots und Promotions
Ausdrucksstarke, markengerechte Sprachaufnahmen mit der Energie und Betonung, die Sie vorgeben.
Prompt-Beispiele
Warme Erzählung
Diese Zeile warm und langsam sprechen, wie beim Trösten eines Kindes: Der Sturm ist vorüber. Du bist jetzt in Sicherheit.
Edit promptSpontane Reaktion
Ich kann nicht glauben, dass du das getan hast [laughs]. Beste Überraschung des Jahres.
Edit promptVom Flüstern zur normalen Stimme
[whispering] Keinen Laut. [normal voice] Okay, die Luft ist rein.
Edit promptEinfache Preise
Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.
Basic
900 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Standard
3200 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro
6200 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro Max
24000 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Enterprise
Für höhere Limits
Individuell
Preis- und Abrechnungsbedingungen

Free
Zum Ausprobieren
$0
dauerhaft kostenlos
Häufig gestellte Fragen
Grok Imagine Image 2.0
xAI
xAIs präzises Bildmodell. Typografie wie vom Designer, bereichsgenaue Edits, Smart Resize.
Seedance 2.5
ByteDance
ByteDances Videomodell der nächsten Generation. Bis zu 30s in nativem 1080p, 50 Referenzen, nativer Ton.
Kling 4.0
Kling
Kuaishous nächstes Kling-Flaggschiff, bald erwartet. Längere Clips und mehr Detailschärfe sind unterwegs.
MiniMax H3
MiniMax
Multimodales Videomodell von MiniMax. 2K, nativer Stereoton, Clips bis 15 Sekunden.