Inworld TTS 2 als KI-Sprachgenerator

95 Stimmen, vierzehn Sprachen. Sprachausgabe in unter einer Sekunde.

Jedes Audiomodell

Ein Arbeitsbereich

Verschiedene Stimmen

Claire

Warm, nah, ohne Eile

Oliver

Ruhig geführt, für lange Texte

Eleanor

Klar und erklärend

Graham

Hell, schnell, nach vorn

Anjali

Gleichmäßig und einladend

Hana

Präzise, gut für Sachtexte

Sprachausgabe in drei Schritten

  1. 01

    Morphic öffnen

    Melden Sie sich an und starten Sie auf einer frei fließenden, unendlichen visuellen Canvas.

  2. 02

    Stimme besetzen, Skript einfügen

    Wählen Sie aus 95 Stimmen in vierzehn Sprachen. Pro Durchgang sind 2.000 Zeichen möglich.

  3. 03

    Erzeugen und verfeinern

    Das Audio kommt in unter einer Sekunde. Tauschen Sie die Stimme, wechseln Sie die Stufe.

Was Inworld TTS 2 erzeugt

Figuren, die in Echtzeit antworten

Der Median bis zum ersten Audio liegt unter 200 Millisekunden. Die Stimme setzt also ein, während das Gespräch noch läuft. Genau das trennt eine Figur, die spricht, von einer, die wartet.

Zwei leuchtende Formen in Rede und Gegenrede vor tiefem Schwarz

Eine Markenstimme für jeden Markt

Dasselbe Skript, dieselbe Stimme, eine Sprache nach der anderen. Die Stimme bleibt über den Wechsel hinweg dieselbe. Eine Kampagne klingt dadurch weltweit nach einem Sprecher statt nach einer Besetzung pro Region.

Ein einzelnes Lichtband, das ungebrochen durch getrennte Bahnen aus Dunkelheit läuft

Ein Ensemble statt einer Stimme

Fünfundneunzig Stimmen in vierzehn nativen Sprachen füllen ein ganzes Schulungsvideo, ohne dass eine davon zweimal vorkommt. Besetzen Sie jede Rolle einmal. Die Besetzung hält dann über jede Korrekturschleife.

Eine modellierte Lichtlinie, deren Ausschlag entlang ihrer Länge anschwillt und wieder abklingt

Lange Texte, durchgehend einheitlich

Arbeiten Sie ein Hörbuch oder einen E-Learning-Kurs Passage für Passage durch, jeweils bis 2.000 Zeichen. Die besetzte Stimme bleibt vom ersten bis zum letzten Kapitel gleich.

Eine lange, langsame Welle mit offenen Abständen zwischen den Kämmen, in Perlweiß und Rosengrau

Alles auf Morphic

Ihr kompletter Werkzeugkasten für Audio

Einfache Preise

Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.

Basic

$9/ Monat
abgerechnet als $0 pro Jahr

1100 monatliche Credits

1 Nutzer

Alle Modelle

Workflows

Standard

$24/ Monat
abgerechnet als $0 pro Jahr

3625 monatliche Credits

1 Nutzer

Alle Modelle

Workflows

Pro

$45/ Monat
abgerechnet als $0 pro Jahr

6350 gemeinsame monatliche Credits

1 Nutzer

+ bis zu 4 weitere gegen Aufpreis

Alle Modelle

Workflows

Pro Max

$170/ Monat
abgerechnet als $0 pro Jahr

24650 gemeinsame monatliche Credits

1 Nutzer

+ bis zu 9 weitere gegen Aufpreis

Alle Modelle

Workflows

Enterprise

Für höhere Limits

Individuell

Preis- und Abrechnungsbedingungen

High-Volume-Credits
Individuelle Platzlimits
Alle Modelle
Workflows
Pricing Gradient

Free

Zum Ausprobieren

$0

dauerhaft kostenlos

Bis zu 20 Credits
Nur 1 Nutzer
Eingeschränkte Modelle
Workflows

Häufig gestellte Fragen

Was ist der KI-Sprachgenerator Inworld TTS 2?
Inworld TTS 2 ist das Modell Realtime TTS-2 von Inworld, betrieben auf Morphic. Sie wählen eine von fünfundneunzig fertigen Stimmen und fügen Ihr Skript ein. Das Audio kommt in Echtzeit zurück und liegt sofort auf Ihrer Canvas. Alles läuft im Browser, ohne Download und ohne Installation.
Spricht Inworld TTS 2 auch Deutsch?
Ja. Jede Stimme spricht jede der über 100 unterstützten Sprachen, und der Wechsel gelingt innerhalb einer einzigen Generierung. Die Stimme bleibt dabei dieselbe. Ein zweisprachiges Skript klingt deshalb nach einer Sprecherin und nicht nach zwei zusammengeschnittenen Aufnahmen. Der Katalog selbst deckt vierzehn Sprachen nativ ab, alle weiteren erreichen Sie über diesen sprachübergreifenden Weg.
Wie viele Stimmen stehen zur Auswahl?
Fünfundneunzig fertige Stimmen aus vierzehn nativen Sprachen. Sie sind sofort einsatzbereit. Es gibt kein Setup, keinen Trainingsschritt und keine Referenzaufnahme, die Sie vorher liefern müssten.
Ist der KI-Sprachgenerator auf Morphic kostenlos?
Morphic hat eine kostenlose Stufe. Sie erzeugen also sofort Sprachausgabe, ohne vorher Zahlungsdaten zu hinterlegen. Für größere Mengen und für die kommerzielle Nutzung gibt es kostenpflichtige Tarife.
Was passiert mit dem Skript, das ich einfüge?
Ihr Text geht zur Generierung an das Modell und kommt als Audio auf Ihrer Canvas zurück. Wer Skripte für Kunden verarbeitet, klärt Zweck, Speicherort und Auftragsverarbeitung deshalb vorab. In vielen Agenturen ist es üblich, im Testlauf mit Platzhaltern zu arbeiten. Echte Namen und vertrauliche Details kommen erst in die finale Aufnahme.
Wie schnell kommt die Sprachausgabe zurück?
Der Median bis zum ersten Audio liegt unter 200 Millisekunden. In der Praxis ist der Clip fertig, bevor Sie die eben getippte Zeile zu Ende gelesen haben. Das reicht für interaktive Figuren und für Agents im Live-Betrieb, nicht nur für vorproduzierte Sprecheraufnahmen.
Was ist Inworld TTS 2 Flash?
Eine schnellere und günstigere Stufe auf demselben Katalog aus fünfundneunzig Stimmen. Nutzen Sie sie für Entwürfe und für große Mengen. Für die finale Aufnahme wechseln Sie zurück auf Inworld TTS 2. Die Besetzung bleibt beim Wechsel erhalten, Sie casten also nicht neu.
Wie lang darf mein Skript sein?
Bis zu 2.000 Zeichen pro Generierung. Längere Texte teilen Sie in Passagen und erzeugen diese nacheinander. Die besetzte Stimme bleibt über alle Teile hinweg dieselbe. Auch ein langes Stück bleibt dadurch einheitlich.
Kann ich damit meine eigene Stimme klonen?
Mit Inworld TTS 2 auf Morphic nicht. Das Modell erzeugt aus seinem fertigen Katalog und nicht aus einer Referenzaufnahme von Ihnen. Wenn Sie Voice Cloning brauchen, nutzen Sie dafür ElevenLabs auf Morphic.

Das könnte Ihnen auch gefallen