Multimodal

Gemini Omni

oleh Google DeepMind

Model AI any‑to‑any pertama dari Google.
Teks, gambar, audio, dan video masuk, satu video jadi.

Gemini Omni

Fitur utama

Spesifikasi teknis

Omni Flash

Model pertama di seri Gemini Omni milik Google

Video

Output gambar dan audio direncanakan dalam roadmap Gemini Omni

Hingga 10s

Klip Flash dibatasi 10 detik saat rilis untuk memperluas akses

720p

Gemini Omni Flash menghasilkan video 720p

Campuran apa pun

Teks, gambar, audio, dan video dalam satu prompt

Bawaan

Audio sinkron dihasilkan di tiap klip; suara lewat Avatars

SynthID

Watermark asal-usul AI tak kasat mata di tiap klip

Google DeepMind

Diposisikan sebagai penerus Veo untuk pembuatan video any-to-any

Contoh penggunaan

Storyboard multi-input

Gambar karakter, foto lokasi, cue musik, dan satu beat masuk; model membangun shot lalu beriterasi.

Editing video percakapan

Edit klip apa pun dengan bahasa biasa: ganti wardrobe, ubah latar, atau atur ulang timing sebuah beat. Sisanya tetap stabil.

Video marketing

Potongan iklan yang menghormati warna merek, bentuk produk, dan teks di layar. Satu foto, satu brief, satu spot jadi.

Video edukasi

Visualkan sains, sejarah, dan teknik dengan fisika bawaan. Sainsnya tetap jujur, footage-nya bersih.

Video spokesperson

Satu potret plus referensi suara memberi presenter yang sama di shorts, kursus, dan panduan.

Shorts media sosial

Klip 10 detik pas untuk YouTube Shorts, Reels, dan TikTok. Buat variasi, lalu tayangkan yang paling nendang.

Contoh prompt

Noir sinematik

Noir sinematik

Detektif di gang Tokyo basah kuyup diguyur hujan, cahaya lampu sodium, noir teal-amber

Edit prompt
Peluncuran produk

Peluncuran produk

Sneaker avant-garde melayang di atas alas titanium, key light keras, nuansa peluncuran

Edit prompt
Explainer alam

Explainer alam

Tetesan air membeku jadi mahkota kristal di daun berembun, macro backlit saat matahari terbit

Edit prompt
Spokesperson avatar

Spokesperson avatar

Host studio berwibawa menatap lensa, cahaya three-point hangat, bokeh 85mm

Edit prompt
Walkthrough arsitektur

Walkthrough arsitektur

Cahaya golden hour menembus vila beton brutalis, bayangan panjang, debu melayang

Edit prompt
Momen cerita

Momen cerita

Perempuan di dekat jendela berbintik hujan membaca surat, cemas mereda jadi lega

Edit prompt

Harga sederhana

Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.

Basic

$9/ bulan
ditagih sebagai $0 per tahun

900 bulanan kredit

1 pengguna saja

Semua model

Workflows

Standard

$24/ bulan
ditagih sebagai $0 per tahun

3200 bulanan kredit

1 pengguna saja

Semua model

Workflows

Pro

$45/ bulan
ditagih sebagai $0 per tahun

6200 bersama bulanan kredit

1 pengguna

+ hingga 4 lainnya dengan biaya tambahan

Semua model

Workflows

Pro Max

$170/ bulan
ditagih sebagai $0 per tahun

24000 bersama bulanan kredit

1 pengguna

+ hingga 9 lainnya dengan biaya tambahan

Semua model

Workflows

Enterprise

Untuk batas yang lebih tinggi

Khusus

ketentuan harga dan penagihan

Kredit volume tinggi
Batas kursi khusus
Semua model
Workflows
Pricing Gradient

Free

Untuk bereksperimen

$0

gratis selamanya

Hingga 20 kredit
Hanya 1 pengguna
Model terbatas
Workflows

FAQ

Apa itu Gemini Omni?
Gemini Omni adalah model multimodal any-to-any pertama dari Google, diumumkan di Google I/O 2026. Rilis pertamanya, Gemini Omni Flash, menerima teks, gambar, audio, dan video sebagai input dan menghasilkan video sebagai output, dengan editing percakapan, konsistensi karakter, dan watermark SynthID di tiap klip.
Apakah Gemini Omni model gambar?
Bukan. Gemini Omni menghasilkan video. Model ini menerima gambar sebagai input bersama teks, audio, dan video, tetapi hasil yang dibuat berupa klip video. Google menyebut output modalitas gambar dan audio ada di roadmap Gemini Omni, tetapi belum menjadi bagian dari peluncuran awal.
Bagaimana cara memakai Gemini Omni di Morphic?
Buka Morphic, alihkan prompt bar ke mode Video, dan pilih Gemini Omni dari pemilih model. Lampirkan kombinasi teks, gambar, audio, dan video mana pun, lalu jalankan prompt-nya. Untuk merevisi hasil, cukup minta di pesan berikutnya dan adegan tetap menyimpan konteks sebelumnya.
Berapa durasi video Gemini Omni?
Klip Gemini Omni Flash dibatasi 10 detik saat rilis. Google menyebut batas ini sebagai keputusan deployment untuk memperluas akses saat peluncuran awal, bukan batas keras model, jadi durasi Gemini Omni yang lebih panjang mungkin hadir di rilis mendatang.
Input apa saja yang diterima Gemini Omni?
Gemini Omni menerima teks, gambar, audio, dan video dalam kombinasi apa pun di dalam satu prompt. Referensi suara adalah input audio pertama yang didukung; input audio yang lebih luas dan modalitas output tambahan sedang direncanakan.
Bagaimana Gemini Omni dibandingkan dengan Veo 3.1?
Veo 3.1 adalah model video fotorealistis Google DeepMind dengan resolusi 4K, audio bawaan, dan klip 8 detik, disetel untuk realisme kualitas siaran. Gemini Omni Flash adalah saudara any-to-any-nya, dengan durasi lebih pendek (hingga 10 detik), berfokus pada penalaran multi-input, editing percakapan, dan konsistensi karakter yang bertahan di setiap editan. Veo sang spesialis realisme; Gemini Omni sang sutradara multimodal.
Bagaimana Gemini Omni dibandingkan dengan Seedance 2.0?
Gemini Omni dan Seedance 2.0 sama-sama model video multimodal. Seedance 2.0 menerima hingga 12 aset campuran per generasi dengan sintesis audio bawaan dan sinkronisasi beat musik, pada 1080p, 4 sampai 15 detik. Gemini Omni Flash berfokus pada editing percakapan giliran demi giliran dan pada pemodelan fisika serta dunia nyata milik Google, saat ini dibatasi 10 detik.
Apakah Gemini Omni menyertakan watermark?
Ya. Setiap video yang dihasilkan Gemini Omni membawa watermark SynthID tak kasat mata dari Google untuk menandai asal-usul AI. Watermark ini tak terlihat oleh penonton dan bertahan melewati editan umum seperti re-encoding dan pengubahan ukuran.
Apakah Gemini Omni mendukung konsistensi karakter?
Ya. Karakter yang diperkenalkan di satu shot Gemini Omni mempertahankan wajah, pakaian, dan suaranya di setiap potongan dan di editan berikutnya dalam percakapan yang sama, tanpa perlu mengunggah ulang referensi tiap giliran.
Kapan Gemini Omni dirilis?
Google mengumumkan Gemini Omni di Google I/O 2026 pada 19 Mei 2026. Gemini Omni Flash adalah rilis pertama di keluarga ini, dengan output gambar dan audio disebut sebagai penambahan yang direncanakan ke depan.