Inworld TTS 2
بواسطة Inworld
خمسة وتسعون صوتًا، وأكثر من 100 لغة.
يبدأ الصوت في أقل من ثانية.

الميزات الأساسية
المواصفات التقنية
95
أصوات جاهزة عبر أربع عشرة لغة أصلية
100+
نطق عابر للغات بهوية صوتية واحدة
2000 حرف
أقصى طول للنص في التوليد الواحد
أقل من 200ms
وسيط زمن الوصول إلى أول صوت
MP3 بمعدل 48 kHz
صوت بمعدل كامل، جاهز للمونتاج
2
Inworld TTS 2 وInworld TTS 2 Flash
حالات الاستخدام

شخصيات تفاعلية
كلام يبدأ بسرعة تكفي لإدارة حوار. زمن الاستجابة هنا هو الميزة، لا هامش على الصفحة.

سرد وتعليق صوتي
اختر الراوي مرة واحدة. يبقى الصوت نفسه في كل قطع وكل إعادة تسجيل وكل تعديل.

تعليق صوتي متعدد اللغات
شغّل النص نفسه بلغات كثيرة مع صوت واحد، فتصمد هوية العلامة بعد الترجمة.

كتب صوتية ومحتوى طويل
اعمل على الكتاب فقرة فقرة، والراوي ثابت من فصل إلى فصل.

حوار الألعاب والشخصيات الجانبية
وزّع الأدوار على طاقم كامل. خمسة وتسعون صوتًا تكفي لملء قرية دون تكرار صوت واحد.

شروحات ودروس
إذا تغيّر المنتج، أعد توليد السطر المعني وحده. لا حاجة إلى حجز جلسة تسجيل جديدة.
أمثلة على الأوامر






نظرة عامة
يبدأ الموسم التجاري في الخليج بنص واحد يُنطق عشرات المرات. إعلان لرمضان، ثم نسخة قصيرة للريلز، ثم إعادة تسجيل لأن العرض تغيّر. وكل إعادة كانت تعني حجز الاستوديو من جديد.
Inworld TTS 2 هو نموذج Realtime TTS-2 لتحويل النص إلى كلام من Inworld. صدر في 31 أغسطس 2026، ووصل إلى Morphic في اليوم نفسه. يقرأ النص بواحد من خمسة وتسعين صوتًا جاهزًا. ويحمل الصوت نفسه عبر أكثر من 100 لغة. ويعيد الملف بسرعة تكفي لمحادثة قائمة.
ما الذي يميّز Inworld TTS 2
أمران يفصلانه عن بقية نماذج الكلام. أولهما زمن الاستجابة. وسيط الوصول إلى أول صوت أقل من 200 ملي ثانية. عند هذا الحد يخرج تحويل النص إلى كلام من باب الانتظار. ويدخل باب التفاعل، حيث تجيب الشخصية واللاعب ما زال يسمع.
وثانيهما أن الصوت غير مربوط بلغة واحدة. أي صوت في الكتالوج ينطق أي لغة مدعومة، وتصمد الهوية عبر التبديل داخل التوليد الواحد. فيعود النص ثنائي اللغة بصوت متحدث واحد، لا كأنه تسجيلان جُمعا معًا. وهذا ما يبقي صوت العلامة الواحد حيًّا بعد الترجمة.
Inworld TTS 2 على Morphic
يظهر Inworld TTS 2 في قائمة نماذج الصوت ضمن الكلام، إلى جانب ElevenLabs وGemini 3.1 Flash TTS. حوّل شريط الطلب إلى الصوت، واختر الكلام. ثم عيّن Inworld TTS 2، واختر صوتًا. ألصق النص وولّد. يقبل التوليد الواحد حتى 2000 حرف. ويعود الناتج ملف MP3 بمعدل 48 kHz، مباشرة على Canvas.
والمستويان متاحان معًا. Inworld TTS 2 هو الافتراضي. أما Inworld TTS 2 Flash فيسحب من الكتالوج نفسه بإعداد أسرع وأقل تكلفة. وهو يناسب العمل بالحجم الكبير والمسودات. والانتقال بينهما لا يفرض إعادة اختيار الصوت.
أسعار بسيطة
ابدأ مجاناً اليوم، مع إمكانية الترقية أو الإلغاء في أي وقت.
Basic
1100 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Standard
3625 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Pro
6350 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Pro Max
24650 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Enterprise
لحدود أعلى
مخصص
شروط الأسعار والفوترة

Free
للتجربة والاستكشاف
$0
مجاني إلى الأبد
الأسئلة الشائعة
ChatGPT Images 2.5
OpenAI
نموذج الصور من OpenAI، صدر في سبتمبر 2026. تفاصيل أدق، وتحرير محدّد، وسرعة أعلى.
Lyria 3.5
Google DeepMind
أغانٍ كاملة ببنية وغناء وكلمات. اكتب طلبك بالعربية، تُغنَّ بالعربية.
MiniMax H3 Max Turbo
fal.ai
المستوى السريع من H3 المطور لدى fal. ضعف السرعة، والمظهر نفسه تقريبًا.
Gemini Omni Flash 1.1
Google DeepMind
نموذج الفيديو من Google، حيث التعديل جملة تكتبها. والآن بدقة 4K ومشاهد تصل إلى 40 ثانية.