Gemini Omni
بواسطة Google DeepMind
أول نموذج من Google من أي شكل إلى أي شكل.
نص وصور وصوت وفيديو كمدخلات، وفيديو واحد كمخرج.

الميزات الأساسية
المواصفات التقنية
Omni Flash
أول نموذج في عائلة Gemini Omni من Google
فيديو
مخرجات الصور والصوت مخطط لها ضمن خارطة طريق Gemini Omni
حتى 10 ثوانٍ
مقاطع Flash محدودة بـ10 ثوانٍ عند الإطلاق لتوسيع الوصول
720p
ينتج Gemini Omni Flash فيديو بدقة 720p
أي مزيج
نص وصورة وصوت وفيديو في أمر واحد
أصلي
صوت متزامن يُنشأ مع كل مقطع؛ الصوت عبر Avatars
SynthID
علامة مائية غير محسوسة لإثبات مصدر الذكاء الاصطناعي على كل مقطع
Google DeepMind
موقع كخلَف لـ Veo في إنشاء الفيديو من أي شكل إلى أي شكل
حالات الاستخدام
لوحة قصة متعددة المدخلات
تدخل صورة شخصية، وصورة موقع، ومقطع موسيقي، وفكرة موجزة؛ ويبني النموذج اللقطة ويكرّرها.
تحرير فيديو حواري
حرّر أي مقطع بلغة عادية: بدّل الزي، غيّر الخلفية، أو أعد توقيت حركة. يبقى الباقي ثابتًا.
فيديو تسويقي
لقطات إعلانية تحترم ألوان العلامة التجارية، وشكل المنتج، والنص الظاهر على الشاشة. صورة واحدة، وموجز واحد، وإعلان واحد جاهز.
شروحات تعليمية
تصوّر العلوم والتاريخ والهندسة بفيزياء مدمجة. يبقى العلم دقيقًا واللقطات نظيفة.
فيديو ناطق باسم
صورة شخصية مع مرجع صوتي يمنحان نفس المقدّم أمام الكاميرا عبر مقاطع قصيرة ودورات وشروحات.
مقاطع اجتماعية قصيرة
مقاطع مدتها 10 ثوانٍ تناسب YouTube Shorts وReels وTikTok. أنشئ اختلافات، ثم انشر الأنسب.
أمثلة على الأوامر

نوار سينمائي
محقق في زقاق طوكيو المبلل بالمطر، توهج مصابيح الصوديوم، نوار بألوان مزرقة وكهرمانية
Edit prompt
إطلاق منتج
حذاء رياضي طليعي معلّق في الهواء فوق قاعدة من التيتانيوم، إضاءة رئيسية حادة، أجواء إطلاق
Edit prompt
شرح طبيعي
قطرة ندى متجمدة كتاج بلوري على ورقة مندّاة، لقطة ماكرو مضاءة خلفيًا عند شروق الشمس
Edit prompt
ناطق افتراضي (Avatar)
مقدّم استوديو رزين يخاطب العدسة، إضاءة دافئة ثلاثية النقاط، عدسة 85 ملم بضبابية خلفية
Edit prompt

نظرة عامة
Gemini Omni هو أول نموذج من Google متعدد الوسائط من أي شكل إلى أي شكل، أُعلن عنه في مؤتمر Google I/O لعام 2026 بتاريخ 19 مايو 2026. الإصدار الأول، Gemini Omni Flash، يقبل النص والصور والصوت والفيديو في أمر واحد وينتج فيديو واحدًا، مع تحرير حواري، واتساق للشخصيات، وفيزياء دقيقة، وعلامة مائية SynthID على كل مقطع.
ما الذي يميّز Gemini Omni
بدلًا من ربط الوسائط ببعضها، يستنتج Gemini Omni عبرها جميعًا. أمر يتضمن صورة بورتريه مرجعية، وصورة موقع، وعينة صوتية، وفكرة من سطر واحد، ينتج لقطة واحدة تعكس كل مدخل في آنٍ واحد. تعدّل الأوامر اللاحقة المشهد نفسه، لا مشهدًا جديدًا، بحيث تثبت الشخصيات والإضاءة والاستمرارية عبر الجولات.
Gemini Omni على Morphic
على Morphic، يقع Gemini Omni ضمن قائمة نماذج الفيديو إلى جانب Veo 3.1 وSeedance 2.0 وKling وبقية كتالوج الفيديو. بدّل شريط الأوامر إلى وضع Video، اختر Gemini Omni، أرفق المراجع بأي مزيج، وواصل تحرير المشهد نفسه عبر الأوامر اللاحقة.
أسعار بسيطة
ابدأ مجاناً اليوم، مع إمكانية الترقية أو الإلغاء في أي وقت.
Basic
1100 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Standard
3625 شهرياً أرصدة
1 مستخدم فقط
جميع النماذج
Workflows
Pro
6350 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Pro Max
24650 مشترك شهرياً أرصدة
1 مستخدم
جميع النماذج
Workflows
Enterprise
لحدود أعلى
مخصص
شروط الأسعار والفوترة

Free
للتجربة والاستكشاف
$0
مجاني إلى الأبد
الأسئلة الشائعة
ChatGPT Images 2.5
OpenAI
نموذج الصور من OpenAI، صدر في سبتمبر 2026. تفاصيل أدق، وتحرير محدّد، وسرعة أعلى.
Lyria 3.5
Google DeepMind
أغانٍ كاملة ببنية وغناء وكلمات. اكتب طلبك بالعربية، تُغنَّ بالعربية.
MiniMax H3 Max Turbo
fal.ai
المستوى السريع من H3 المطور لدى fal. ضعف السرعة، والمظهر نفسه تقريبًا.
Inworld TTS 2
Inworld
خمسة وتسعون صوتًا، وأكثر من 100 لغة. يبدأ الصوت في أقل من ثانية.