توليد الصوت
متاح الآن

Inworld TTS 2

بواسطة Inworld

خمسة وتسعون صوتًا، وأكثر من 100 لغة.
يبدأ الصوت في أقل من ثانية.

Inworld TTS 2

الميزات الأساسية

المواصفات التقنية

95

أصوات جاهزة عبر أربع عشرة لغة أصلية

100+

نطق عابر للغات بهوية صوتية واحدة

2000 حرف

أقصى طول للنص في التوليد الواحد

أقل من 200ms

وسيط زمن الوصول إلى أول صوت

MP3 بمعدل 48 kHz

صوت بمعدل كامل، جاهز للمونتاج

2

Inworld TTS 2 وInworld TTS 2 Flash

حالات الاستخدام

عقدتان مضيئتان يصل بينهما خيط ضوء مشدود، إحداهما تجيب الأخرى

شخصيات تفاعلية

كلام يبدأ بسرعة تكفي لإدارة حوار. زمن الاستجابة هنا هو الميزة، لا هامش على الصفحة.

شريط ضوء طويل ثابت، حبيباته متساوية على امتداده كله

سرد وتعليق صوتي

اختر الراوي مرة واحدة. يبقى الصوت نفسه في كل قطع وكل إعادة تسجيل وكل تعديل.

شريط من الضوء ينقسم إلى شرائط متوازية تسير في تناسق

تعليق صوتي متعدد اللغات

شغّل النص نفسه بلغات كثيرة مع صوت واحد، فتصمد هوية العلامة بعد الترجمة.

لولب بطيء من ضوء كهرماني ينحسر في العمق بلفّات متساوية

كتب صوتية ومحتوى طويل

اعمل على الكتاب فقرة فقرة، والراوي ثابت من فصل إلى فصل.

نقاط ضوء صغيرة كثيرة موزّعة في العمق، تربطها خيوط باهتة

حوار الألعاب والشخصيات الجانبية

وزّع الأدوار على طاقم كامل. خمسة وتسعون صوتًا تكفي لملء قرية دون تكرار صوت واحد.

درجات مضيئة متتابعة صاعدة تنحسر في العمق

شروحات ودروس

إذا تغيّر المنتج، أعد توليد السطر المعني وحده. لا حاجة إلى حجز جلسة تسجيل جديدة.

أمثلة على الأوامر

تفتّح ناعم لضوء ذهبي شاحب عند حافة الإطار

ترحيب دافئ

القهوة جاهزة. تفضّل واجلس، واحكِ لي كل شيء.

Edit prompt
طيّة رقيقة من ضوء عاجي يلمع على ثنيتها

افتتاحية فصل

الفصل الأول. انحسر البحر ذلك الصباح، ولم يعد كما كان.

Edit prompt
خيط واحد ناعم من ضوء عاجي دافئ يلتفّ لفّة واحدة

خطوة في وصفة

اخلط الطحين مع الزبدة حتى يتماسك العجين.

Edit prompt
خطان رفيعان من ضوء أبيض بارد يلتقيان عند نقطة

خبر عاجل

لن تصدّق من اتصل قبل قليل.

Edit prompt
شبكة دقيقة من ضوء فضي رمادي مرئية عن قرب

ترحيب بدورة

أهلًا بعودتك. لنكمل من حيث توقفنا.

Edit prompt
تناقص بطيء لضوء كهرماني ناعم ينتهي عند نقطة

معلومات جولة

تبدأ الجولة عند التاسعة، أمام البوابة الشمالية.

Edit prompt

نظرة عامة

يبدأ الموسم التجاري في الخليج بنص واحد يُنطق عشرات المرات. إعلان لرمضان، ثم نسخة قصيرة للريلز، ثم إعادة تسجيل لأن العرض تغيّر. وكل إعادة كانت تعني حجز الاستوديو من جديد.

Inworld TTS 2 هو نموذج Realtime TTS-2 لتحويل النص إلى كلام من Inworld. صدر في 31 أغسطس 2026، ووصل إلى Morphic في اليوم نفسه. يقرأ النص بواحد من خمسة وتسعين صوتًا جاهزًا. ويحمل الصوت نفسه عبر أكثر من 100 لغة. ويعيد الملف بسرعة تكفي لمحادثة قائمة.

ما الذي يميّز Inworld TTS 2

أمران يفصلانه عن بقية نماذج الكلام. أولهما زمن الاستجابة. وسيط الوصول إلى أول صوت أقل من 200 ملي ثانية. عند هذا الحد يخرج تحويل النص إلى كلام من باب الانتظار. ويدخل باب التفاعل، حيث تجيب الشخصية واللاعب ما زال يسمع.

وثانيهما أن الصوت غير مربوط بلغة واحدة. أي صوت في الكتالوج ينطق أي لغة مدعومة، وتصمد الهوية عبر التبديل داخل التوليد الواحد. فيعود النص ثنائي اللغة بصوت متحدث واحد، لا كأنه تسجيلان جُمعا معًا. وهذا ما يبقي صوت العلامة الواحد حيًّا بعد الترجمة.

Inworld TTS 2 على Morphic

يظهر Inworld TTS 2 في قائمة نماذج الصوت ضمن الكلام، إلى جانب ElevenLabs وGemini 3.1 Flash TTS. حوّل شريط الطلب إلى الصوت، واختر الكلام. ثم عيّن Inworld TTS 2، واختر صوتًا. ألصق النص وولّد. يقبل التوليد الواحد حتى 2000 حرف. ويعود الناتج ملف MP3 بمعدل 48 kHz، مباشرة على Canvas.

والمستويان متاحان معًا. Inworld TTS 2 هو الافتراضي. أما Inworld TTS 2 Flash فيسحب من الكتالوج نفسه بإعداد أسرع وأقل تكلفة. وهو يناسب العمل بالحجم الكبير والمسودات. والانتقال بينهما لا يفرض إعادة اختيار الصوت.

أسعار بسيطة

ابدأ مجاناً اليوم، مع إمكانية الترقية أو الإلغاء في أي وقت.

Basic

$9/ شهر
تُفوتر باعتبارها $0 سنوياً

1100 شهرياً أرصدة

1 مستخدم فقط

جميع النماذج

Workflows

Standard

$24/ شهر
تُفوتر باعتبارها $0 سنوياً

3625 شهرياً أرصدة

1 مستخدم فقط

جميع النماذج

Workflows

Pro

$45/ شهر
تُفوتر باعتبارها $0 سنوياً

6350 مشترك شهرياً أرصدة

1 مستخدم

+ حتى 4 المزيد بتكلفة إضافية

جميع النماذج

Workflows

Pro Max

$170/ شهر
تُفوتر باعتبارها $0 سنوياً

24650 مشترك شهرياً أرصدة

1 مستخدم

+ حتى 9 المزيد بتكلفة إضافية

جميع النماذج

Workflows

Enterprise

لحدود أعلى

مخصص

شروط الأسعار والفوترة

أرصدة كبيرة الحجم
حدود مقاعد مخصصة
جميع النماذج
Workflows
Pricing Gradient

Free

للتجربة والاستكشاف

$0

مجاني إلى الأبد

حتى 20 رصيد
مستخدم واحد فقط
نماذج محدودة
Workflows

الأسئلة الشائعة

ما هو Inworld TTS 2؟
هو نموذج Realtime TTS-2 لتحويل النص إلى كلام من Inworld، وصدر في 31 أغسطس 2026. يقرأ النص بواحد من خمسة وتسعين صوتًا جاهزًا. وتبقى هوية الصوت نفسها عبر أكثر من 100 لغة. ويعود الصوت بسرعة الزمن الحي، لا بعد انتظار المعالجة.
كم عدد الأصوات واللغات المدعومة؟
الكتالوج يضم خمسة وتسعين صوتًا جاهزًا موزّعة على أربع عشرة لغة أصلية. أما النطق فعابر للغات، ويغطي أكثر من 100 لغة. أي صوت يستطيع نطق أي لغة مدعومة. لذلك فاللغة الأصلية للصوت تصف كيف صُمم، لا حدًا يقف عنده.
هل يتحدث Inworld TTS 2 بالعربية؟
أي صوت في الكتالوج ينطق أي لغة من اللغات المدعومة، وعددها يتجاوز 100. فتستطيع تشغيل نص عربي بالصوت الذي اخترته، وتبقى الهوية الصوتية كما هي. أما اللغات الأربع عشرة الأصلية فغير مسمّاة، ولا نزعم أن العربية بينها. جرّب سطرًا قصيرًا أولًا واحكم بأذنك قبل أن تبني عليه حملة كاملة.
هل يستطيع صوت واحد التحدث بأكثر من لغة؟
نعم، وحتى داخل التوليد الواحد. تنتقل هوية الصوت عبر التبديل دون أن تنكسر. فيعود النص ثنائي اللغة بصوت متحدث واحد، لا كأنه تسجيلان مركّبان معًا. وهذا بالضبط ما يجعل صوت العلامة الواحد قابلًا للنقل بين الأسواق.
ما الفرق بين Inworld TTS 2 وInworld TTS 2 Flash؟
يتشاركان الكتالوج نفسه بأصواته الخمسة والتسعين. يمنحك Inworld TTS 2 الأداء الأكمل. أما Inworld TTS 2 Flash فمستوى أسرع وأقل تكلفة، ويناسب العمل بالحجم الكبير والمسودات. والتبديل بينهما لا يعني إعادة اختيار الصوت.
ما أقصى طول للنص؟
حتى 2000 حرف في التوليد الواحد. وإذا كان النص أطول، قسّمه إلى فقرات وولّدها تباعًا. يبقى الصوت المختار نفسه في كل فقرة، فيخرج العمل الطويل بنبرة واحدة.
ما الفرق بينه وبين ElevenLabs على Morphic؟
كلاهما ينتج كلامًا بجودة بشرية على Morphic. غير أن ElevenLabs حزمة صوتية كاملة: كلام وموسيقى ومؤثرات، مع ضبط دقيق للصوت. أما Inworld TTS 2 فمخصص للكلام وحده، وقوته في زمن الاستجابة وفي ثبات الصوت عبر اللغات. وكثير من صنّاع المحتوى يستعملون الاثنين معًا، هذا للكلام وذاك للموسيقى والمؤثرات.
كيف أستخدم Inworld TTS 2 على Morphic؟
افتح Morphic، وحوّل شريط الطلب إلى الصوت، ثم اختر الكلام. عيّن Inworld TTS 2 نموذجًا، واختر الصوت، وألصق النص، ثم ولّد. يهبط الملف الصوتي على Canvas بجانب مقاطع الفيديو الخاصة بك.