Kling 3.0 nedir? Özellikler, prompt ipuçları ve kullanım alanları

Kling 3.0 nedir? Özellikler, prompt ipuçları ve kullanım alanları

Kling 3.0 hakkında bilmeniz gereken her şey. Nasıl prompt yazılır, Kling 2.6'dan neler değişti, yetenekler, teknik özellikler ve gerçek kullanım alanları.

Kling 3.0 nedir?

Kling 3.0, Kuaishou'nun Şubat 2026'da yayımladığı bir video üretim modelidir. Daha önceki iki modelin, Kling Video 2.6 ve Kling O1'in, tek bir bütünleşik mimaride birleştirilmesiyle oluşturuldu. Video 2.6, hareket kontrolüyle metinden videoya ve görselden videoya üretimi üstleniyordu. Kling O1 ise görsel kalite ve tutarlılığa odaklanıyordu. Kling 3.0, ikisini video, ses ve öğe tutarlılığını tek bir geçişte üreten tek bir modelde birleştirir.

Sonuç, bir klip üreticisinden çok bir sahne yönetmeni gibi çalışan bir modeldir. Promptunuzda bir anlatı tarif edersiniz; Kling 3.0 çekimleri planlar, kamera açılarını atar, dudak senkronlu senkronize diyalog üretir ve karakterleri her kesme boyunca görsel olarak tutarlı tutar. Çıktı, native 4K'ya kadar çözünürlüklerde 3 ila 15 saniyelik süreleri destekler.

Morphic'te Kling 3.0, video üretim paketinin bir parçası olarak kullanılabilir. Onu Morphic'in görsel, müzik ve ses araçlarıyla aynı çalışma alanında kullanabilirsiniz; bu da bir proje birden fazla formatta varlık gerektirdiğinde işe yarar.

Kling 3.0'a nasıl prompt yazılır

Promptunuzu yazma biçiminiz, çıktıyla ilgili her şeyi değiştirir. Kling 3.0 bir video modelidir; bu da yalnızca görsel görünüme değil, harekete, zamanlamaya ve kamera yönlendirmesine yanıt verdiği anlamına gelir. En iyi sonuçları veren promptlar, bir fotoğraf alt yazısı gibi değil, bir kısa film için sahne tarifi gibi okunur.

İşte farklı video içeriği türlerinde güçlü sonuçlar almak için bir prompt yazma çerçevesi.

1. Kamera diliyle başlayın

Promptunuzun ilk kelimeleri, tüm üretimin görsel tonunu belirler. Kling 3.0 sinematik terminolojiyi anlar ve doğrudan yanıt verir. Başka bir şeyi tarif etmeden önce belirli bir kamera davranışını adlandırmak, modeli tutarlı bir görsel yaklaşıma kilitler.

Kötü promptİyi prompt
"A woman walking through a city at night, cinematic look""Handheld tracking shot following a woman in a dark coat walking through rain-slicked city streets at night, neon reflections on the pavement, shallow depth of field"

İlk prompt, kamera davranışını tamamen modele bırakır. İkincisi ise tam olarak nasıl hareket edeceğini söyler: handheld, tracking, özneyi takip eden. Ayrıca sahneyi, ışığı ve atmosferi belirleyen somut ortam detaylarıyla temellendirir.

Kling 3.0'ın iyi yanıt verdiği kamera terimleri: tracking shot, orbital pan, macro close-up, POV, whip-pan, slow push-in, static wide shot ve handheld with subtle drift.

2. Çok çekimli promptları etiketli çekimlerle yapılandırın

Tek bir üretimde birden fazla kamera açısı istediğinizde, her çekimi açıkça etiketleyin. Kling 3.0, çekim sayısını, her birinin süresini ve karede ne olacağını tanımladığınız özel bir çok çekim modunu destekler. Çekim etiketleriniz ne kadar netse, model onları o kadar isabetli izler.

Kötü promptİyi prompt
"A man orders food at a restaurant, then the waiter brings the meal, then he eats""Shot 1: medium shot of a man in a navy shirt sitting at a restaurant table, scanning the menu, warm interior lighting. Shot 2: over-the-shoulder close-up of the menu in his hands, his finger pointing at an item. Shot 3: wide shot of the waiter approaching the table carrying a plate, the man looking up. Shot 4: close-up of the plate being set down on the table, steam rising from the food."

İlk prompt bir olaylar dizisini tarif eder ama modele görsel bir yönlendirme vermez. İkincisi ise anlatıyı, her biri belirli bir kadraj, özne konumu ve görsel detaya sahip ayrı çekimlere böler. Özel çok çekim modu tam da bunun için tasarlanmıştır.

3. Konuşmacıları diyaloglarıyla doğrudan etiketleyin

Diyaloglu sahnelerde Kling 3.0'ın hangi karakterin hangi cümleyi söylediğini bilmesi gerekir. Açık etiketleme olmadan model, sesleri yanlış yüzlere atayabilir ya da özellikle üç veya daha fazla karakterde konuşmacı karışıklığı yaratabilir.

Kötü promptİyi prompt
"Two people sit at a cafe table and talk about their weekend plans and whether they should go hiking or stay in the city""A young woman in a white blouse and a man in a grey jacket sit at an outdoor cafe table. The woman lifts her coffee cup and says 'I was thinking we could do the coastal trail on Saturday.' The man leans back and replies 'That works, but we should leave early before it gets too hot.'"

İlk prompt konuşma konusunu özetler ama modele gerçek bir diyalog ya da konuşmacı ataması vermez. İkincisi ise her karakteri fiziksel bir tarif ve kendi cümlesiyle eşleştirir; böylece model dudak hareketlerini ve sesi doğru yüzle eşleştirebilir.

4. Karakterleri sabitlemek için referans görseller kullanın

Bir referans görsel yüklediğinizde, Kling 3.0 onu üretim boyunca görsel bir çapa olarak kullanır. Bu, özellikle birden fazla çekim ya da ayrı üretimler arasında tutarlılık korumak için, bir karakterin görünümünü yalnızca metinle tarif etmekten daha güvenilirdir.

Referanslardan en iyi şekilde yararlanmak için:

  • Mümkünse karakteri farklı açılardan gösteren 2-4 referans görsel yükleyin. Bu, modele kilitlenebileceği daha fazla görsel veri sağlar.
  • Bir video referansı yüklerseniz model, hem karakterin görünümünü hem de doğal ses tonunu çıkarıp ikisini de üretim boyunca tutarlı tutabilir.
  • Ürün videoları için, kamera hareketi sırasında marka, metin ve renkleri tutarlı tutmak amacıyla ürün görselini referans olarak yükleyin.

5. Statik sahneleri değil, zaman içindeki hareketi ve eylemi tarif edin

Bir video modeline prompt yazarken en sık yapılan hata, bir fotoğrafı tarif eden bir prompt yazmaktır. Kling 3.0 hareket üretir; bu yüzden promptunuzun, klibin süresi boyunca şeylerin nasıl değiştiğini tarif etmesi gerekir: öznenin nasıl hareket ettiğini, kameranın nasıl yanıt verdiğini ve sahnenin nasıl geliştiğini.

Kötü promptİyi prompt
"A perfume bottle on a velvet surface with soft lighting and rose petals""Camera slowly orbits around a glass perfume bottle on a dark velvet surface, soft golden light catching the facets of the bottle as it rotates into view, scattered rose petals shift gently from the air movement, the camera gradually tightens from a wide framing to a close-up of the label"

İlk prompt bir sabit görseli tarif eder. İkincisi ise kameranın nasıl hareket ettiğini, ışığın zamanla nesneyle nasıl etkileştiğini ve kadrajın nasıl değiştiğini tarif eder. Bu, modele izleyeceği net bir hareket yolu verir.

Kling 3.0'da yenilikler

Kling 3.0, Kling Video 2.6'ya göre önemli bir yükseltmedir. Aşağıdaki tablo, resmi Kling 3.0 model dokümantasyonuna dayanarak neyin değiştiğini gösterir.

YetenekKling Video 2.6Kling Video 3.0
Metinden videoyaEvetEvet
Görselden videoyaEvetEvet
Başlangıç ve bitiş karesinden videoyaEvetEvet
Yerleşik sesEvetEvet
Çok çekimli üretimHayırEvet
Başlangıç karesi + öğe referansıHayırEvet
Çoklu karakter eş referansı (3+)HayırEvet
Çok dilli destek (Çince, İngilizce, Japonca, Korece, İspanyolca)HayırEvet
Lehçeler ve aksanlarHayırEvet
15 saniyelik çıktı süresiHayırEvet
Esnek süre (3-15 saniye)HayırEvet
Native 4K çözünürlükHayırEvet

En dikkat çekici eklemeler çok çekimli üretim ve öğe referans sistemidir. Çok çekim, tek bir üretimde altı kamera kesmesine kadar izin vererek tek tek klip üretip bunları manuel olarak birleştirme ihtiyacını ortadan kaldırır. Öğe referans sistemi, bir karakterin görsel görünümünü ve ses tonunu yeniden kullanılabilir bir öğeye bağlamanızı sağlar; böylece tutarlılık çekimler ve hatta ayrı video üretimleri arasında korunur.

Lehçe ve aksan işlemeli çok dilli destek de yenidir. Kling 2.6 yerleşik sesi destekliyordu, ancak 3.0 bunu belirli aksanları taklit etme yeteneğiyle beş dile genişletir (İngilizce için Amerikan, İngiliz, Hint; Çince için Kantonca, Kuzeydoğu, Pekin, Siçuan, Tayvan) ve tek bir sahne içinde diller arası geçişi (code-switching) işler.

Kling 3.0 yetenekleri

Çok çekimli storyboard üretimi

Kling 3.0, çok çekimli video için iki mod sunar. Otomatik modda çok çekim anahtarını etkinleştirirsiniz ve model, kamera geçişlerini, çekim kadrajını ve temposunu kendi başına planlamak için sahne tarifinizi okur. Özel modda ise her çekimi tek tek tanımlar; süreyi, kamera açısını ve anlatı içeriğini belirtirsiniz. Model, storyboard'unuzu birebir izler.

Özel mod, her kesmenin zamanlamasının önemli olduğu ürün reklamları ya da diyalog sekansları gibi yapılandırılmış içerikler için özellikle kullanışlıdır. Otomatik mod ise, modelin anlatısal bir promptu yorumlamasını ve görsel kapsamı belirlemesini istediğinizde iyi çalışır.

Karaktere özgü ses bağlamalı yerleşik ses

Video ve ses tek bir geçişte üretilir. Model dudak senkronlu diyalog üretir ve karakterleri promptta diyaloglarıyla eşleştirerek hangi karakterin hangi cümleyi söyleyeceğini kontrol edebilirsiniz. Temel dudak senkronizasyonunun ötesinde Kling 3.0, bağlı ses tonlarına sahip karakter öğeleri oluşturmayı destekler. Bir sesi bir karakter öğesine bağladığınızda, o ses karakter her göründüğünde yeniden belirtmenize gerek kalmadan tutarlı kalır.

Model; İngilizce, Çince, Japonca, Korece ve İspanyolca diyalogları, lehçe ve aksan desteğiyle ve tek bir sahne içinde çok dilli code-switching ile destekler.

Öğe referans sistemi

2-4 referans görsel ya da kısa bir referans video yükleyerek yeniden kullanılabilir karakter öğeleri oluşturabilirsiniz. Karakter öğeleri için ayrıca ses yükleyerek ya da mevcut seslerden seçerek bir ses tonu atayabilirsiniz. Bir öğeyi bir promptta kullandığınızda model, karakterin görünümünü ve sesini video boyunca kilitler ve kamera hareketleri, sahne değişimleri ve çok çekimli sekanslar boyunca bile tutarlılığı korur.

Bu sistem, özellikleri birbirine karıştırmadan aynı karede üç ya da daha fazla farklı karakteri destekler; bu da diyalog sahneleri ve birden fazla kişinin olduğu her video için kritiktir.

Metin ve logo korunması

Model; tabelalar, ürün etiketleri ya da logolar gibi yüklenen görsellerdeki metin içeriğini tanıyabilir ve metni video boyunca tutarlı tutabilir. Ayrıca videonun içinde yeni metin içeriği de üretebilir. Metin, sürekli kamera hareketi sırasında bile okunaklı kalır; bu da marka öğelerinin keskin ve okunaklı kalması gereken ticari içerikler için kullanışlıdır.

Esnek süre ve çözünürlük

Kling 3.0, tek bir geçişte 3 ila 15 saniyelik video üretir ve native 4K'ya kadar çözünürlükleri destekler. Uzatılmış süre, modele daha karmaşık anlatı gelişimi, sahne geçişleri ve daha kısa kliplere sığmayacak aksiyon sekansları için alan tanır. Çözünürlük seçenekleri ayrıca 1080p ve 720p'yi de içerir.

Kling 3.0 teknik özellikleri

ÖzellikDetaylar
Üretim modlarıMetinden videoya, görselden videoya, başlangıç ve bitiş karesinden videoya
Maksimum süre15 saniye
Minimum süre3 saniye
Maksimum çözünürlükNative 4K
Diğer çözünürlükler1080p, 720p
En boy oranları16:9, 9:16, 1:1
Çok çekimÜretim başına 6 kamera kesmesine kadar
Çok çekim modlarıOtomatik (model çekimleri planlar) ve Özel (kullanıcı her çekimi tanımlar)
Yerleşik sesDudak senkronlu diyalog, ses tonu kontrolü
Desteklenen dillerİngilizce, Çince, Japonca, Korece, İspanyolca
Lehçe ve aksan desteğiEvet (Çince ve İngilizce lehçeleri, bölgesel aksanlar)
Code-switchingEvet (tek sahnede birden fazla dil)
Karakter öğeleri2-4 görsel ya da video referansından oluşturulur
Ses bağlamaSes tonu karakter öğelerine bağlı
Çoklu karakter eş referansıTek karede 3+ farklı karakter
Metin korunmasıYüklenen görsellerden metin okur ve korur
Model kökeniKling Video 2.6 + Kling O1 birleşiminden
Yayın tarihiŞubat 2026

Kling 3.0 kullanım alanları

Kısa format film yapımcıları ve anlatı üreticileri

Çok çekimli üretim, Kling 3.0'ı kısa anlatı içerikleri için özellikle kullanışlı kılan şeydir. Çekim-karşı çekim diyaloğu, tanıtım çekimleri ve yakın çekimlerle tam bir sahneyi tek bir geçişte üretebilirsiniz. Kısa dramalar, mikro seriler ya da hikâye odaklı sosyal içerik üzerinde çalışan üreticiler için bu, tek tek klip üretip birleştirme işini ortadan kaldırır. Altı kesmeye kadar 15 saniyelik süre, tek bir üretim içinde giriş, gelişme ve sonuç için yeterli alan verir.

Ürün ve e-ticaret videosu

Ürün reklamları, marka metni ve logolar keskin kalırken kameranın bir nesnenin etrafında hareket etmesini gerektirir. Kling 3.0'ın metin korunması bunu yerleşik olarak halleder ve etiketleri orbital çekimler ile takip hareketleri sırasında okunaklı tutar. Öğe referans sistemiyle birleştirildiğinde, bir ürünün görsel kimliğini kilitleyip farklı kamera açıları, ışık kurulumları ya da arka plan ortamlarıyla birden fazla reklam varyasyonu üretebilir, ürünün kendisi tutarlı kalır. Morphic'te ürün videosunu üretip ardından eşleşen küçük resimleri ya da sosyal varlıkları aynı çalışma alanında oluşturabilirsiniz.

Sosyal medya içerik ekipleri

Esnek en boy oranları (16:9, 9:16, 1:1) ile hızlı iterasyonun birleşimi, her format için ayrı üretim iş akışları olmadan platforma özel video içeriği üretebilmeniz anlamına gelir. Otomatik storyboard'lu çok çekim modu burada kullanışlıdır: içerik konseptini tarif edersiniz, çekim planlamasını model üstlenir. Instagram, TikTok, YouTube Shorts ve akış gönderileri arasında hacim ihtiyacı olan ekipler için bu, üretim döngüsünü belirgin biçimde hızlandırır.

Çok dilli ve yerelleştirilmiş içerik

Lehçe ve code-switching desteği, çoğu yapay zeka video modelinin işleyemeyeceği kullanım alanları açar. Bir sunucunun Korece konuştuğu bir eğitim videosu, karakterlerin konuşma ortasında İngilizce ile İspanyolca arasında geçiş yaptığı bir turizm reklamı ya da otantik bölgesel aksanların yer aldığı bir sosyal klip; hepsi doğal dudak hareketleri ve tutarlı yüz ifadeleriyle üretilir. Birden fazla pazarı hedefleyen markalar için bu, aynı prompt çerçevesinden ses yeniden kaydetmeden yerelleştirilmiş video içeriği üretmek demektir.

Morphic'te Kling 3.0'ı platformun görsel ve ses araçlarıyla eşleştirerek videodan küçük resme, arka plan müziğine kadar eksiksiz bir içerik paketini ayrı uygulamalar arasında geçiş yapmadan oluşturabilirsiniz.

SSS

Kling 3.0 Morphic'te kullanılabilir mi?

Kling 3.0 Morphic'te kullanılabilir. Bir Morphic planına kaydolun, prompt çubuğundan Video modunu seçin ve model açılır menüsünden Kling 3.0'ı seçin. Görsel, müzik ve ses üretim araçlarının yanında yer alır; böylece birden fazla içerik türü üzerinde tek bir çalışma alanında çalışabilirsiniz.

Kling 3.0 ile Kling 3.0 Omni arasındaki fark nedir?

Her iki model de metinden videoya ve görselden videoya işler ama farklı kullanım alanlarına hizmet eder. Kling 3.0, çok çekimli storyboard'lama ve yerleşik sese sahip temel üretim modelidir. Kling 3.0 Omni ise bunu daha derin öğe tutarlılığı kontrolleri, video tabanlı karakter referansları ve ses tonu bağlamayla genişletir. Bir prompttan tek bir cilalı video istiyorsanız Kling 3.0 doğru seçimdir. Aynı karakterlerin birden fazla üretim boyunca göründüğü bir seri kuruyorsanız, Omni bunu korumak için tutarlılık araçlarını verir.

Kling 3.0 ses için hangi dilleri destekler?

Model, beş dilde dudak senkronlu diyalog üretir: İngilizce, Çince, Japonca, Korece ve İspanyolca. Temel dil desteğinin ötesine geçerek belirli lehçe ve aksanları işler; İngilizce için Amerikan, İngiliz ve Hint aksanları, Çince için Kantonca, Kuzeydoğu, Pekin, Siçuan ve Tayvan lehçeleri dahil. Karakterler ayrıca aynı klip içinde konuşma ortasında diller arasında geçiş yapabilir.

Kling 3.0'da çok çekimli üretim nasıl çalışır?

Çok çekim, tek bir video içinde altı farklı kamera kesmesine kadar üretir. İki seçeneğiniz var: modelin promptunuza göre çekim geçişlerini planladığı otomatik mod ve her çekimin kadrajını, süresini ve kamera açısını kendiniz tanımladığınız özel mod. Özel modda model storyboard'unuzu birebir izler. Otomatik modda anlatınızı yorumlar ve en iyi görsel kapsamı belirler. Her iki mod da tüm kesmeler boyunca karakter tutarlılığını korur.

Kling 3.0 hangi çözünürlük ve süreyi destekler?

Maksimum çözünürlük native 4K'dır; yani video yükseltilmek yerine bu çözünürlükte üretilir. Daha hızlı üretim ya da daha küçük dosya boyutları için 1080p ve 720p de mevcuttur. Süre, üretim başına 3 ila 15 saniye arasında değişir. Desteklenen en boy oranları 16:9, 9:16 ve 1:1'dir; geniş ekran, dikey ve kare formatlarını kapsar.