Gemini 3.1 Flash TTS
بواسطة Google DeepMind
أكثر نماذج تحويل النص إلى كلام تعبيراً من Google، مع وسوم صوتية وحوار متعدد المتحدثين.

الميزات الأساسية
المواصفات التقنية
متعدد اللغات
تحكم بالأسلوب والإيقاع واللكنة عبر لغات كثيرة
حتى 2
صوتان مميزان في توليد واحد متعدد المتحدثين
وسوم صوتية
ملاحظات باللغة الطبيعية وإشارات بين الأقواس
SynthID
علامة مائية غير محسوسة لإثبات المصدر على المخرجات
حالات الاستخدام
سرد وتعليق صوتي للفيديو
أضف سرداً طبيعياً إلى فيديو بالذكاء الاصطناعي أو بلقطات حية، بالنبرة والإيقاع المحددين بلغة بسيطة.
حوار الشخصيات
أنطق مشاهد بمتحدثَين للأفلام القصيرة والألعاب والفيديوهات التوضيحية، لكل شخصية صوتها.
تعليق صوتي مترجم
اسرد النص نفسه بلغات كثيرة بإيقاع أصيل وتحكم باللكنة.
كتب صوتية ومحتوى طويل
حافظ على أداء طبيعي وثابت عبر مقاطع السرد الطويلة.
شروحات ودروس تعليمية
سرد واضح وقابل للتوجيه لجولات المنتج والدروس والإرشادات.
قراءات إعلانية وترويجية
قراءات صوتية تعبيرية ومتوافقة مع العلامة، بالطاقة والتشديد اللذين توجّههما.
أمثلة على الأوامر
أسعار بسيطة
ابدأ مجاناً اليوم، مع إمكانية الترقية أو الإلغاء في أي وقت.
Basic
900 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Standard
3200 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Pro
6200 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Pro Max
24000 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Enterprise
لحدود أعلى
مخصص
شروط الأسعار والفوترة

Free
للتجربة والاستكشاف
$0
مجاني إلى الأبد
الأسئلة الشائعة
Seedance 2.5
ByteDance
نموذج الفيديو الجيل القادم من ByteDance. مقاطع أصلية حتى 30 ثانية، 50 مرجعًا، صوت أصلي.
Kling 4.0
Kling
النموذج الرائد التالي من Kling لدى Kuaishou، متوقّع قريبًا. مقاطع أطول وتفاصيل أدق قادمة.
MiniMax H3
MiniMax
نموذج الفيديو متعدد الوسائط من MiniMax. صورة وصوت معًا بدقة 2K، ومقاطع حتى 15 ثانية.
Flux 3
Black Forest Labs
نموذج العالم من Black Forest Labs للصورة والفيديو والصوت، بصوت يطابق الحدث.