Gemini Omni özellikleri ve yetenekleri
Gemini Omni, Google'ın 19 Mayıs 2026'da Google I/O 2026'da duyurduğu ilk any-to-any modelidir. İlk sürüm olan Gemini Omni Flash, girdi olarak metin, görsel ve video alır ve Gemini'nin gerçek dünya bilgisine dayanan, senkronize sesli video üretir. Klipler 16:9 veya 9:16 formatında 720p çözünürlükte 10 saniyeye kadar sürer ve bunları yeniden üretmek yerine sohbet ederek işlersiniz.
| Özellik | Ne yapar | En uygun kullanım |
|---|---|---|
| Any-to-any girdi | Metin, görsel ve videoyu tek promptta birleştirir ve bunları birbirine eklemek yerine tek bir sahneye dönüştürerek birlikte değerlendirir | Çok referanslı brief'ler, storyboard'lar |
| Yerleşik ses | Her klibe aynı geçişte senkronize ses üretir, ayrı bir ses adımı gerekmez | Konuşma sahneleri, ortam sesi, müzik |
| Sohbet tarzı düzenleme | Bir klibi sade dille takip istekleriyle işleyin: aynı sahnede bir nesneyi değiştirin, yeniden aydınlatın veya eylemi değiştirin | Bir çekimi yeniden üretmeden geliştirmek |
| Karakter ve fizik tutarlılığı | Karakterleri, nesneleri ve stili düzenlemeler arasında korur; yerçekimi, kinetik enerji ve akışkan dinamiği gerçekçidir | Tekrarlayan karakterler, gerçekçi hareket |
| Gerçek dünya bilgisi | Gemini'nin tarih, bilim ve kültür bilgisinden yararlanır, böylece sahne detayları doğru kalır | Anlatım videoları, doğru detay |
| SynthID filigranı | Her klipte, yeniden kodlama ve boyutlandırmaya dayanan görünmez bir köken filigranı | İzlenebilir, tanımlanabilir yapay zeka içeriği |
Any-to-any girdi
Tek bir Gemini Omni promptu metin, görsel ve videoyu aynı anda kabul eder. Model, girdileri sırayla birbirine eklemek yerine tek bir brief olarak birlikte değerlendirir; böylece bir portre referansı, bir mekân fotoğrafı ve yazılı bir anlatı öğesi aynı üretilen çekimi birlikte biçimlendirir. Belirli özneleri sahneye taşımak için birden fazla referans görsel de verebilirsiniz. Ayrı ses referansları yükleme özelliği kademeli olarak sunuluyor ve henüz her yerde kullanılamıyor; Google'ın Gemini uygulamasında ise Avatars ile kendi sesinizle videolarda görünebilirsiniz.
Yerleşik ses
Her klip aynı geçişte kendi senkronize sesiyle üretilir; böylece diyalog, efektler, ortam sesi ya da müzik sessiz bir render yerine hareketle birlikte gelir. İstediğiniz sesi sahneyle aynı promptta tarif edin; ses sonradan eklenmek yerine eyleme göre zamanlanır.
Sohbet tarzı düzenleme
Düzenleme, promptun kendisidir. Bir klibi sade dille takip istekleriyle işleyin: "heykeli baloncuklardan yap", sahneyi yeniden aydınlat, bir eylemi değiştir ya da bir öğe ekle; model çekimin geri kalanını korur. Bağlamı turlar arasında tutar, böylece birkaç düzenleme turu sıfırdan başlamak yerine aynı sahnenin üzerine kurulur.
Karakter ve fizik tutarlılığı
Karakterler, nesneler ve stil, yerçekimi, kinetik enerji ve akışkan dinamiği gibi kuvvetlere ilişkin gelişmiş bir kavrayışla desteklenerek sohbet tarzı düzenlemeler boyunca korunur. Tutarlılık, aynı sahneyi işlediğinizde en yüksektir. Sahne değiştirmek ya da büyük kamera kaydırmaları istemek kaymaya yol açabilir; bu yüzden büyük değişiklikleri kendi üretimine bırakın.
Gerçek dünya bilgisi
Gemini Omni, sahnelerini Gemini'nin tarih, bilim ve kültür bilgisine dayandırır; böylece dönem detayları, fiziksel davranış ve kültürel özellikler generik yapay zeka dokusuna kaymak yerine doğru kalır. Modeli anlatım videoları ve detayların doğru olması gereken her çekim için kullanışlı kılan da tam olarak bu dayanaktır.
SynthID filigranı
Her klip, yapay zeka kökeninin işaretlenmesi için Google'ın algılanamayan SynthID filigranını taşır. Varsayılan olarak açıktır, izleyiciler için görünmezdir ve yeniden kodlama ile boyutlandırma gibi yaygın dönüşümlere dayanır; böylece üretilen materyal üretim zinciri boyunca tanımlanabilir kalır.
Gemini Omni prompt örnekleri


Ürün lansmanı
Avant-garde sneaker mid-air over a titanium plinth, hard key light, launch mood
Edit prompt


Mimari gezinti
Golden-hour light through a brutalist concrete villa, long shadows, drifting dust
Edit prompt
Gemini Omni'den en iyi sonucu nasıl alırsınız
Gemini Omni, her referansı tek bir sahnenin parçası olarak ele alan, sesi adlandıran ve yeniden üretmek yerine sohbet ederek işleyen bir brief'i ödüllendirir. Kalitenin büyük kısmını birkaç uygulama taşır:
- Tüm referansları aynı anda yükleyin. Metin, bir görsel ve bir video aynı prompta girebilir, çünkü model bunları sırayla işlemek yerine birlikte değerlendirir. Belirli bir özneyi sahneye taşımak için referans görseller ekleyin.
- Sesi her zaman adlandırın. Diyalog, ses efektleri, ortam sesi ya da müziği sade bir dille belirtin; böylece klip sessiz kalmak yerine harekete göre zamanlanmış sesle gelir.
- Sohbet ederek işleyin. Bir çekim yaklaştığında, sıfırdan başlamak yerine istediğiniz tek değişikliği bir sonraki mesajda tarif edin. Sahne karakterlerini, ışığını ve sürekliliğini korur.
- Anı 10 saniyeye sığdırın. Video uzatma veya ara kare üretimi yoktur; bu yüzden sonradan uzatmaya güvenmek yerine klip içinde çözülen tek bir eylem planlayın.
- Sahne değişikliklerini kendi üretimine bırakın. Tutarlılık, aynı sahneyi işlediğinizde en yüksektir; sert bir sahne değişimi ya da büyük bir kaydırma, yeni bir çekim olarak daha iyidir.
- Önemsediğiniz fiziği yönlendirin. Ağırlığı, çarpışmayı ya da bir sıvının nasıl hareket etmesi gerektiğini belirtin; çünkü gerçekçi fizik, yönlendirmeye değer bir güçtür.
Gemini Omni prompt rehberi
Güçlü bir prompt, bir alt yazı gibi değil, kısa bir çekim brief'i gibi okunur. Sonucu iki şey belirler: çekimin neleri içerdiğine dair net bir liste ve muğlak ifadeler yerine somut bir dil.
Bir prompta neler girer
| Öğe | Neyi içermeli | Örnek |
|---|---|---|
| Özne | Karede kim ya da ne var, somut olarak tarif edilmiş | a studio host in a charcoal blazer at a glass desk |
| Hareket | Ne hareket ediyor ve nasıl | she turns to the lens and gestures |
| Kamera | Çekim türü artı bir hareket | medium shot, slow push-in |
| Ses | Diyalog, efektler, ortam sesi ya da müzik | she says, 'Welcome back'; soft studio room tone |
| Format | Süre ve en boy oranı | 10 seconds, 16:9 |
Sohbet ederek düzenleme
Düzenleme, promptun kendisidir. Sahneyi koruyun, yalnızca değişikliği adlandırın ve geri kalan her şeyi önceki turdan devralın.
Same host and desk, same lighting. Change her blazer to deep green and add a slow push-in over the last two seconds. Keep the room tone from before.
Zayıf ve güçlü promptlar
Kamerayı, hareketi ve zamanlamasını, sesi rastlantıya bırakmak yerine adlandırın.
| Odak | Zayıf | Güçlü |
|---|---|---|
| Kamera | A woman in a city at night | Handheld tracking shot following a woman through rain-slicked streets, shop lights reflecting on the pavement, shallow depth of field |
| Hareket ve zamanlama | The door opens and someone walks in | The door swings open slowly, a figure steps through after a beat, then the camera settles into a medium shot |
| Ses | A chef plating a dish | Close-up of a chef plating a dish, steam rising. Audio: pan sizzle, soft kitchen ambience, and 'Service.' |
Sık yapılan hatalar
- Promptu sessiz bırakmak: model sesi videoyla birlikte ürettiği için her zaman en az bir ses ipucu yazın.
- Düzenlemek yerine yeniden üretmek: bir çekim yaklaştığında, karakterler ve süreklilik korunsun diye tek değişikliği sohbet ederek isteyin.
- Uzatmaya güvenmek: video uzatma yoktur; bu yüzden tek bir eylemi 10 saniyelik klip içinde tutun.
- Yoğun ekran metni: metin işleme ve çok karmaşık hareket hâlâ zayıf noktalardır; bu yüzden alt yazıları kısa tutun ya da sonradan ekleyin.

