Inworld TTS 2
Inworld tarafından
Doksan beş ses, 100'den fazla dil.
Ses, saniyenin altında başlıyor.

Öne çıkan özellikler
Teknik özellikler
95
On dört yerel dile yayılmış hazır sesler
100+
Diller arası; tek ses kimliği hepsinde korunuyor
2.000 karakter
Üretim başına en uzun metin
200 ms altı
İlk sese kadar geçen medyan süre
MP3, 48 kHz
Tam kaliteli ses, kurguya hazır
2
Inworld TTS 2 ve Inworld TTS 2 Flash
Kullanım örnekleri

Etkileşimli karakterler
Sohbeti sürdürecek kadar hızlı başlayan konuşma. Burada gecikme bir dipnot değil, işin kendisi.

Anlatım ve seslendirme
Anlatıcıyı bir kez seçin. Her kesmede, her ek çekimde ve her revizyonda aynı ses kalır.

Yerelleştirilmiş seslendirme
Aynı metni birçok dilde çalıştırın. Ses değişmediği için marka, çeviriden geçtiğinde de tanınır kalır.

Sesli kitap ve uzun metin
Kitabı bölüm bölüm ilerletin. Anlatıcının tonu bölümler boyunca yerinde durur.

Oyun ve NPC diyalogları
Bütün bir kadro kurun. Doksan beş ses, aynı sesi ikinci kez kullanmadan bir köyü doldurmaya yeter.

Tanıtım ve eğitim videoları
Üründe bir şey değiştiğinde tek bir cümleyi yeniden üretin. Stüdyo randevusu almanız gerekmez.
Prompt örnekleri


Bölüm başlangıcı
Birinci bölüm. O sabah deniz çekildi ve bir daha tam olarak geri gelmedi.
Edit prompt



Genel bakış
Inworld TTS 2, Inworld'ün Realtime TTS-2 metinden konuşmaya modeli. 31 Ağustos 2026'da yayımlandı ve aynı gün Morphic'te kullanıma açıldı. Metninizi doksan beş hazır sesten biriyle okuyor. Seçtiğiniz ses 100'den fazla dilde aynı kalıyor. Sonuç, canlı bir konuşmanın içine sığacak kadar hızlı geliyor.
Bir KOBİ'nin ürün tanıtımı, bir YouTube kanalının anlatımı, bir eğitim setinin ders sesi. Üçü de aynı kataloğa bakıyor ve aynı anlatıcıyla ilerleyebiliyor.
Inworld TTS 2'yi ayıran ne
Konuşma modelleri arasında iki noktada ayrışıyor. İlki gecikme. İlk sese kadar geçen medyan süre 200 milisaniyenin altında. Bu süre, metinden konuşmayı üret ve bekle sınıfından çıkarıyor. Oyuncu hâlâ dinlerken cevap vermesi gereken bir karakter böylece mümkün oluyor.
İkincisi, sesin bir dile bağlı olmaması. Katalogdaki her ses, desteklenen her dili okuyabiliyor. Tek bir üretimin ortasında dil değişse bile kimlik yerinde kalıyor. İki dilli bir metin, birleştirilmiş iki ayrı kayıt gibi değil, tek bir konuşmacı gibi geliyor. Tek bir marka sesinin yerelleştirmeden geçtiğinde ayakta kalması da buna dayanıyor.
Morphic'te Inworld TTS 2
Morphic'te Inworld TTS 2, Speech için ses modeli seçicisinde duruyor. Yanında ElevenLabs ve Gemini 3.1 Flash TTS var. Prompt çubuğunu Audio'ya alın, Speech'i seçin ve Inworld TTS 2'yi işaretleyin. Ardından bir ses seçip metninizi yapıştırın ve üretin. Her üretim 2.000 karaktere kadar metin alıyor. Ses, 48 kHz MP3 olarak doğrudan Canvas'ınıza düşüyor.
İki seviye var. Varsayılan olan Inworld TTS 2. Inworld TTS 2 Flash aynı doksan beş sesli katalogdan daha hızlı ve daha düşük maliyetli çalışıyor, bu yüzden yoğun işlere ve taslaklara uygun. İkisi arasında geçiş yapmak sesi yeniden seçmek anlamına gelmiyor.
Basit fiyatlandırma
Bugün ücretsiz başlayın, istediğiniz zaman yükseltme veya iptal etme seçeneğiyle.
Basic
1100 aylık kredi
1 yalnızca kullanıcı
Tüm modeller
Workflows
Standard
3625 aylık kredi
1 yalnızca kullanıcı
Tüm modeller
Workflows
Pro
6350 paylaşılan aylık kredi
1 kullanıcı
Tüm modeller
Workflows
Pro Max
24650 paylaşılan aylık kredi
1 kullanıcı
Tüm modeller
Workflows
Enterprise
Daha yüksek limitler için
Özel
fiyatlandırma ve faturalandırma koşulları

Free
Denemek için
$0
kalıcı olarak ücretsiz
SSS
ChatGPT Images 2.5
OpenAI
OpenAI'ın görsel modeli, Eylül 2026'da çıktı. Daha net ayrıntı, hassas düzenleme, daha hızlı üretim.
Lyria 3.5
Google DeepMind
Google'ın en iyi müzik modeli. Yapısı, vokali ve sözleriyle tam şarkı.
MiniMax H3 Max Turbo
fal.ai
fal'ın H3 Max modelinin hızlı katmanı. İki katı hız, neredeyse aynı görüntü.
Gemini Omni Flash 1.1
Google DeepMind
Google'ın video modeli: düzenleme artık bir cümle. 4K çıktı ve 40 saniyelik sahneler geldi.