Kling 3.0 على Morphic: الميزات والفيديو متعدد اللقطات والصوت الأصلي

Kling 3.0 على Morphic: الميزات والفيديو متعدد اللقطات والصوت الأصلي

ولّد فيديوهات سينمائية بالذكاء الاصطناعي مع Kling 3.0 على Morphic. لوحات قصصية متعددة اللقطات، و4K أصلي، وصوت مدمج، وحتى 15 ثانية لكل مقطع.

كيفية استخدام Kling 3.0 على Morphic

1. اختيار وضع الفيديو

من شريط الأوامر، اختر وضع الفيديو (Video mode). هذا يبدّل الواجهة إلى توليد الفيديو، حيث يمكنك ضبط إعدادات مثل الدقة والمدة وما إذا كنت ستضمّن الصوت الأصلي.

2. اختيار Kling 3.0 نموذجًا

افتح قائمة النماذج المنسدلة واختر Kling 3.0 من قائمة نماذج الفيديو المتاحة. يوفّر Morphic نماذج فيديو متعددة، فيمكنك مقارنة المخرجات عبر مولّدات مختلفة دون تبديل المنصات.

3. إضافة أمرك النصي

صِف المشهد الذي تريده. أدرج تفاصيل عن الموضوع والبيئة وحركة الكاميرا والإضاءة وأي حوار. فكّر كمخرج لا كمصوّر: صِف ما يحدث عبر الزمن، لا مجرد إطار ثابت. إن أردت لقطات متعددة، فعّل مفتاح تعدد اللقطات (multi-shot toggle) أو علّم كل لقطة في أمرك.

4. التوليد

شغّل الأمر. ينتج Kling 3.0 مقاطع فيديو بطول يتراوح بين 3 و15 ثانية، مع تضمين الصوت الأصلي عند تفعيله. راجع المخرجات، وعدّل أمرك إن لزم، وأعِد التوليد حتى تحصل على المقطع الذي تريده.

ما هو Kling 3.0؟

Kling 3.0 هو أحدث نماذج توليد الفيديو بالذكاء الاصطناعي من Kuaishou، وصدر في فبراير 2026. يبني على نموذجَي Kling Video 2.6 وKling O1 بدمجهما في بنية موحّدة متعددة الوسائط تتعامل مع الفيديو والصوت والنص في تمريرة توليد واحدة.

حيث كانت نماذج الفيديو السابقة بالذكاء الاصطناعي تنتج مقاطع أحادية اللقطة معزولة دون صوت، يولّد Kling 3.0 تسلسلات متعددة اللقطات بحوار متزامن ومخرجات صوت أصلي. يفهم النموذج اللغة السينمائية (لقطات التتبّع، اللقطات القريبة، اللقطة واللقطة المعاكسة) ويستطيع تخطيط انتقالات المشاهد بنفسه حين تصف سردًا في أمرك.

Kling 3.0 متاح على Morphic كجزء من مجموعة توليد الفيديو متعددة النماذج في المنصة، ما يعني أنه يمكنك استخدامه إلى جانب أدوات الصور والموسيقى والصوت في Morphic في مساحة العمل نفسها.

ميزات Kling 3.0 وقدراته

إخراج لوحة قصصية متعددة اللقطات بوضعَي تحكم

هذه هي الميزة التي تفصل Kling 3.0 عن كل نموذج فيديو آخر بالذكاء الاصطناعي متاح حاليًا. يولّد حتى ست قطعات كاميرا في توليد واحد، ويمنحك طريقتين للتحكم بها:

  • تعدد اللقطات التلقائي (Auto multi-shot): فعّل مفتاح تعدد اللقطات وسيخطّط النموذج انتقالات اللقطات بنفسه بناءً على أمرك. يقرأ وصف مشهدك ويقرّر أين يقطع وأي زاوية يستخدم وكيف يضبط إيقاع التسلسل.
  • تعدد اللقطات المخصّص (Custom multi-shot): تحدّد كل لقطة يدويًا. اضبط عدد اللقطات ومدة كل واحدة وزاوية الكاميرا وما يحدث في الإطار. يتبع النموذج لوحتك القصصية بدقة.

يعمل الوضع التلقائي جيدًا حين تريد نتائج سريعة من أمر سردي. والوضع المخصّص أفضل حين تحتاج تحكمًا دقيقًا، مثل بناء إعلان منتج بإيقاع محدد لقطةً بلقطة.

مراجع العناصر مع ربط الصوت

تتيح لك معظم نماذج الفيديو بالذكاء الاصطناعي رفع صورة مرجعية لتثبيت مظهر الشخصية. يذهب Kling 3.0 أبعد من ذلك. يمكنك رفع مقطع فيديو قصير مرجعًا، فيستخرج النموذج مظهر الشخصية البصري ونبرة صوتها الطبيعية معًا. تُربط تلك النبرة بعنصر الشخصية، فيبقى الصوت متسقًا في كل مرة تتحدّث فيها تلك الشخصية في فيديوك دون حاجتك إلى تحديده مجددًا في الأمر.

يمكنك أيضًا إنشاء عناصر من 2 إلى 4 صور مرجعية وتعيين نبرة صوت بشكل منفصل برفع مقطع صوتي أو الاختيار من الأصوات المتاحة. هذا مفيد بشكل خاص للشخصيات المتكررة عبر عدة عمليات توليد فيديو.

اللهجات واللكنات والتبديل اللغوي متعدد اللغات

يدعم الصوت الأصلي في Kling 3.0 خمس لغات: الإنجليزية والصينية واليابانية والكورية والإسبانية. لكنه يذهب أعمق من دعم اللغة الأساسي. يستطيع النموذج محاكاة لهجات ولكنات محددة، منها الكانتونية ولهجة شمال شرق الصين والسيتشوانية ولهجة بكين للصينية، واللكنات الأمريكية والبريطانية والهندية للإنجليزية.

كما يتعامل مع التبديل اللغوي، أي أن الشخصيات تستطيع التنقل بين اللغات في منتصف المحادثة داخل الفيديو نفسه. اجتماع عمل ثنائي اللغة، أو سائح يسأل عن الاتجاهات بإسبانية مكسّرة، أو مشهد عائلي يمزج اللهجات، كلها تُولَّد بحركات شفاه طبيعية وتعابير وجه متسقة.

مخرجات فيديو 4K أصلي

يدعم النموذج دقة تصل إلى 4K أصليًا، لا مُكبَّرة من دقة أقل. هذا يعني أن الخامات وتفاصيل البشرة والعناصر الدقيقة مثل نسيج القماش وخصلات الشعر تحمل تفاصيل أصيلة بدلًا من المظهر الناعم المطموس الذي ينتجه التكبير. تتوفّر أيضًا دقات أقل (1080p و720p)، ويدعم النموذج نسب الأبعاد 16:9 و9:16 و1:1.

الحفاظ على النص والشعار أثناء حركة الكاميرا

يستطيع Kling 3.0 قراءة النص من الصور المرفوعة، مثل اللافتات أو ملصقات المنتجات أو الشعارات، وإبقاء ذلك النص واضحًا طوال الفيديو حتى مع تحرّك الكاميرا. كما يستطيع توليد محتوى نصي جديد داخل الفيديو نفسه. وللعمل التجاري حيث يجب أن يبقى نص العلامة التجارية حادًا أثناء دوران المنتج أو لقطة التتبّع، يزيل هذا الحاجة إلى طبقات نصية في مرحلة ما بعد الإنتاج.

ثبات الشخصية عبر التسلسلات متعددة اللقطات

ارفع صورًا مرجعية أو مقطع فيديو مرجعيًا قصيرًا، فيثبّت النموذج مظهر الشخصية طوال المقطع. تبقى الوجوه والملابس والنسب والتفاصيل المميِّزة ثابتة عبر حركات الكاميرا مثل التكبير والتحريك الأفقي والإمالة. يدعم النموذج ثلاث شخصيات مميّزة أو أكثر في المشهد نفسه دون مزج ملامحها، وهو ما يهمّ في مشاهد الحوار وأي فيديو بأشخاص متعددين.

مدة مرنة من 3 إلى 15 ثانية

ولّد ما بين 3 و15 ثانية من الفيديو المتصل في تمريرة واحدة. الطول الإضافي ليس عن المقاطع الأطول فحسب. بل يمنح النموذج مساحةً لتطوير حركة أكثر تعقيدًا، وبناء انتقالات المشاهد، وترك القوس السردي يكتمل بدلًا من التوقف عند حاجز الخمس ثوانٍ.

الأسئلة الشائعة

هل Kling 3.0 متاح على Morphic؟

Kling 3.0 متاح على Morphic كجزء من مجموعة توليد الفيديو. للبدء بالتوليد، سجّل في خطة Morphic، واختر وضع الفيديو من شريط الأوامر، ثم اختر Kling 3.0 من قائمة النماذج المنسدلة. يمنحك Morphic الوصول إلى Kling 3.0 إلى جانب أدوات توليد الصور والموسيقى والصوت، فيبقى سير عملك الإبداعي كله في مكان واحد.

ما الفرق بين Kling 3.0 وKling 3.0 Omni؟

Kling 3.0 هو نموذج توليد الفيديو الأساسي الذي يغطّي تحويل النص إلى فيديو وتحويل الصورة إلى فيديو مع لوحة قصصية متعددة اللقطات وصوت أصلي. أما Kling 3.0 Omni فيبني على ذلك بضوابط أقوى لثبات الشخصية والقدرة على ربط نبرات الصوت بشخصيات محددة باستخدام مراجع فيديو. لمعظم احتياجات توليد الفيديو، يكون Kling 3.0 نقطة البداية الصحيحة. ويستحق Omni الاختيار حين يكون ثبات الشخصية عبر عدة عمليات توليد أولويةً.

ما اللغات واللكنات التي يدعمها الصوت؟

يولّد Kling 3.0 حوارًا متزامن الشفاه بخمس لغات: الإنجليزية والصينية واليابانية والكورية والإسبانية. وإلى جانب دعم اللغة القياسي، يستطيع النموذج محاكاة لكنات ولهجات محددة، منها اللكنات الأمريكية والبريطانية والهندية للإنجليزية، ولهجات الكانتونية وشمال الصين وبكين والسيتشوانية والتايوانية للصينية. يمكن للشخصيات أيضًا التنقل بين اللغات في منتصف المحادثة داخل المقطع نفسه.

ما الدقة والمدة اللتان يدعمهما Kling 3.0؟

ترتقي المخرجات إلى دقة 4K أصلية، مع توفّر 1080p و720p أيضًا. تستمر كل عملية توليد ما بين 3 و15 ثانية. تشمل نسب الأبعاد 16:9 للشاشة العريضة، و9:16 للمحتوى الاجتماعي العمودي، و1:1 للصيغ المربعة.

كيف أحصل على نتائج أفضل من Kling 3.0؟

أكبر تحوّل من توجيه الصور إلى توجيه الفيديو هو وصف الحركة، لا المظهر فحسب. بعض الأمور التي تحسّن جودة المخرجات:

  • ابدأ بلغة الكاميرا. بدء أمرك بـ «لقطة تتبّع محمولة» أو «تحريك مداري بطيء» يحدّد الطابع البصري للتوليد كله.
  • علّم المتحدثين صراحةً في المشاهد متعددة الشخصيات. اقرن كل شخصية مباشرةً بحوارها في الأمر ليطابق النموذج الأصوات بالوجوه الصحيحة.
  • استخدم وضع تعدد اللقطات المخصّص حين تحتاج تحكمًا دقيقًا في مدة كل لقطة وتأطيرها وزاوية كاميراتها.
  • ارفع صورًا أو فيديو مرجعيًا لثبات الشخصية. إنشاء عنصر بسمات بصرية وصوتية مربوطة يمنح النموذج مرتكزًا ملموسًا للشخصيات المتكررة.

على Morphic، يمكنك التكرار بسرعة بتعديل أمرك وإعادة التوليد دون مغادرة مساحة العمل. لتفصيل أعمق بأمثلة أوامر، راجع دليل Kling 3.0 الكامل.