Multimodal

Gemini Omni Flash 1.1

oleh Google DeepMind

Model video Google: edit cukup Anda ketik.
Kini output 4K dan adegan sampai 40 detik.

Gemini Omni Flash 1.1

Fitur utama

Spesifikasi teknis

Gemini Omni

Rilis Omni Flash kedua di keluarga Omni milik Google

5 tugas

Teks, gambar, referensi, edit, dan perpanjangan

3 sampai 10s

Per generasi; dengan extension, totalnya sampai 40 detik

Sampai 4K

360p dan 720p native, 1080p dan 4K hasil upscale

10 + 3

Sepuluh gambar plus tiga klip video, masing-masing maksimal 3 detik

Native

Dialog, efek suara, dan musik dalam satu proses

16:9, 9:16

Horizontal dan vertikal di semua resolusi

SynthID

Penanda asal tak terlihat di setiap klip yang dihasilkan

Contoh penggunaan

Frame terbelah dua dari adegan kafe pinggir jalan yang sama, fotoreal di kiri dan anime di kanan

Edit yang cukup diketik

Berikan satu klip, sebutkan perubahannya: ganti cuaca, ubah jadi anime, tulis ulang papan namanya. Sisanya tetap utuh.

Seorang perempuan berbicara ke kamera di tengah kalimat, disinari cahaya jendela yang lembut

Karakter yang berbicara

Tulis kalimatnya dan karakter mengucapkannya dengan lip sync, dalam suara yang bertahan di tiap potongan dan tiap edit setelahnya.

Kartu referensi botol parfum, model, dan lokasi disematkan di samping frame iklan yang sudah jadi

Iklan yang setia referensi

Foto produk, foto presenter, dan klip tiga detik gerakan yang Anda mau jadi satu iklan, dengan produknya tetap akurat.

Filmstrip empat panel pesepeda yang sama melintasi jalan toko roti, pelabuhan, mercusuar, dan jalan pantai

Adegan tumbuh jadi 40 detik

Buat beat pembukanya, lalu perpanjang sepuluh detik sekali jalan jadi adegan 40 detik dengan pemain, lokasi, dan musik yang sama.

Patung kinetik dari domino yang menjatuhkan kelereng baja ke lintasan kayu melengkung

Penjelasan dengan fisika

Gravitasi, cairan, dan tumbukan ikut aturan dunia nyata. Pemahaman Gemini soal sains dan sejarah menjaga detailnya tetap tepat.

Frame wawancara nelayan di dermaga berkabut dengan lower third bertuliskan THE COAST ROAD

Teks yang dirender di frame

Teks di layar kembali terbaca, dari lower third sampai papan nama toko, dan edit berikutnya bisa menulis ulang isinya.

Contoh prompt

Pasar malam

Pasar malam sehabis hujan, pedagang berteriak, wajan mendesis

Edit prompt

Potongan berwaktu

Setiap dua detik, potong ke rooftop lain saat golden hour

Edit prompt

Teks di layar

Papan nama diner menyala huruf demi huruf: OPEN ALL NIGHT

Edit prompt

Satu shot menerus

Lintasan kelereng di bengkel yang disinari matahari, satu shot utuh

Edit prompt

Kalimat terucap

Seorang pendaki membisikkan kalimat puncak ke arah angin

Edit prompt

Close-up penuh suara

Close-up kopi pour-over, tiap tetes dan desisnya terdengar

Edit prompt

Ikhtisar

Gemini Omni Flash 1.1 adalah rilis kedua model video multimodal Google DeepMind, dan yang pertama memberi ruang bagi sebuah shot untuk tumbuh. Satu generasi tetap berjalan 3 sampai 10 detik, lengkap dengan audio native. Bedanya, versi 1.1 membawa kontrol yang belum ada di rilis pertama: tangga resolusi dari draft 360p sampai pengiriman 4K, referensi video yang benar-benar mengarahkan hasil, opsi frame akhir yang mengubah dua gambar diam jadi satu gerakan, dan extension yang membawa klip sampai 40 detik tanpa kehilangan pemain atau musiknya.

Apa yang baru di Gemini Omni Flash 1.1

Omni Flash pertama merender semua klip di 720p dan berhenti di sepuluh detik. Versi 1.1 mempertahankan inti yang cepat dan responsif itu, lalu melepas batas-batas di sekelilingnya. Resolusi kini jadi pilihan di tiap generasi: 360p untuk iterasi murah, 1080p atau 4K saat take sudah siap dikirim. Input referensi tumbuh jadi sepuluh gambar plus tiga klip pendek, masing-masing diberi peran di prompt. Dan klip yang sudah jadi bukan lagi akhir dari cerita. Extension membaca potongan terakhir footage lalu melanjutkan adegannya, sepuluh detik sekali jalan, sampai empat kali panjang aslinya.

Edit lewat percakapan, bukan generate ulang

Kebanyakan model video memperlakukan prompt seperti tarikan mesin slot. Omni Flash memperlakukannya sebagai kalimat pembuka sebuah sesi. Model menjaga kondisi adegan antar giliran, jadi “make the jacket red”, “now extend the shot as she turns away”, dan “change the sign to say CLOSED” semuanya mendarat di take yang sama, dengan wajah, kostum, dan suara yang utuh. Instruksi contoh ditulis dalam bahasa Inggris, karena itu bahasa yang dievaluasi Google untuk model ini. Instruksi pendek dengan satu perubahan paling ampuh, dan bagian frame yang tidak pernah Anda sebut adalah bagian yang tidak bergeser.

Gemini Omni Flash 1.1 dan Morphic

Di Morphic, Gemini Omni duduk di pemilih model video bersama Veo 3.1, Seedance 2.5, Kling, dan sisa katalognya. Semuanya jalan di browser, tanpa instalasi dan tanpa GPU khusus. Tulis shotnya sebagai brief yang sudah memuat audio, lampirkan gambar referensi untuk apa pun yang harus tetap konsisten, lalu generate. Hasilnya mendarat di Canvas, tempat brief yang sama bisa dijalankan lewat model lain untuk dibandingkan berdampingan. Lanjutkan menyempurnakan di prompt berikutnya, satu perubahan sekali jalan, dan adegannya tetap membawa konteks dari giliran ke giliran.

Harga sederhana

Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.

Basic

$9/ bulan
ditagih sebagai $0 per tahun

1100 bulanan kredit

1 pengguna saja

Semua model

Workflows

Standard

$24/ bulan
ditagih sebagai $0 per tahun

3625 bulanan kredit

1 pengguna saja

Semua model

Workflows

Pro

$45/ bulan
ditagih sebagai $0 per tahun

6350 bersama bulanan kredit

1 pengguna

+ hingga 4 lainnya dengan biaya tambahan

Semua model

Workflows

Pro Max

$170/ bulan
ditagih sebagai $0 per tahun

24650 bersama bulanan kredit

1 pengguna

+ hingga 9 lainnya dengan biaya tambahan

Semua model

Workflows

Enterprise

Untuk batas yang lebih tinggi

Khusus

ketentuan harga dan penagihan

Kredit volume tinggi
Batas kursi khusus
Semua model
Workflows
Pricing Gradient

Free

Untuk bereksperimen

$0

gratis selamanya

Hingga 20 kredit
Hanya 1 pengguna
Model terbatas
Workflows

FAQ

Apa itu Gemini Omni Flash 1.1?
Gemini Omni Flash 1.1 adalah rilis kedua model video multimodal Google, yang keluar akhir Agustus 2026. Model ini membuat video beserta audio native yang sinkron dari teks, gambar, dan referensi video, lalu mengedit dan memperpanjang footage lewat instruksi bahasa biasa. Versi 1.1 menambahkan tangga resolusi sampai 4K, referensi video yang benar-benar berpengaruh, interpolasi dari frame pertama ke frame terakhir, dan extension yang membawa satu klip sampai 40 detik.
Apa yang baru di Gemini Omni Flash 1.1 dibanding rilis pertama?
Ada empat hal. Resolusi kini bisa dipilih dari 360p sampai 4K, sementara rilis pertama terkunci di 720p. Extension video sudah aktif dan menumbuhkan klip sepuluh detik sekali jalan sampai 40 detik, padahal versi awal berhenti di satu generasi sepuluh detik. Referensi video sekarang benar-benar mengarahkan hasilnya, sampai tiga klip berdurasi tiga detik. Dan image to video menerima frame akhir, jadi model bisa menginterpolasi dua gambar diam yang Anda berikan.
Resolusi apa saja yang dihasilkan Gemini Omni Flash 1.1?
Ada empat pilihan: 360p, 720p, 1080p, dan 4K, dalam 16:9 atau 9:16. Model merender secara native di 360p dan 720p, lalu menghasilkan 1080p dan 4K sebagai upscale dari generasi itu. Praktiknya begini: draft murah di 360p, kunci take di 720p, baru minta resolusi pengiriman setelah shotnya benar.
Berapa lama durasi video Gemini Omni Flash 1.1?
Satu generasi berjalan 3 sampai 10 detik, dengan 8 detik sebagai default. Dari situ extension menumbuhkan klip sepuluh detik sekali jalan sampai total 40 detik, dan karakter, gerakan, serta audio tetap nyambung di tiap sambungan. Model membaca sepuluh detik terakhir sebagai konteks, lalu melanjutkan adegannya. Extension hanya menambah di ujung akhir: tidak bisa menyisipkan di depan atau memanjangkan bagian tengah. Ini berlaku untuk klip buatan model maupun video milik Anda, asalkan durasinya sepuluh detik atau kurang.
Apakah Gemini Omni Flash 1.1 bisa membuat video vertikal 9:16?
Bisa. Rasio 9:16 tersedia di semua resolusi, sama seperti 16:9, jadi konten vertikal untuk TikTok, Reels, atau Shorts tidak perlu dipotong dari frame horizontal. Alur yang hemat: draft di 360p, kunci take di 720p, lalu minta 1080p atau 4K sekali saja. Audionya ikut digenerate bersama gambar, jadi klipnya sudah siap tayang dengan suara, dan extension bisa menumbuhkannya sampai 40 detik kalau satu take terasa kurang.
Referensi apa saja yang diterima Gemini Omni Flash 1.1?
Sampai sepuluh gambar referensi dan tiga video referensi berdurasi tiga detik, berdampingan dengan prompt teks. Gambar bisa mengunci karakter, produk, lokasi, atau gaya, dan tag di prompt menetapkan peran masing-masing. Referensi video membawa kemiripan wajah atau gerakan; audio di dalamnya diabaikan, dan meminta model menalar beberapa video utuh sekaligus tidak didukung.
Bagaimana cara kerja edit lewat percakapan di Gemini Omni Flash 1.1?
Tiap prompt lanjutan mengedit hasil sebelumnya, bukan generate dari nol, dan model menyimpan kondisi adegan antar giliran. Instruksi pendek paling ampuh: “make the phone invisible, keep everything else the same” lebih baik daripada satu paragraf yang mendeskripsikan seluruh frame. Contohnya ditulis dalam bahasa Inggris karena itu bahasa yang dievaluasi Google untuk model ini. Karena tiap giliran menumpuk pada giliran sebelumnya, satu perubahan per giliran menjaga karakter dan gerakan tetap stabil sepanjang rantai edit.
Apakah Gemini Omni Flash 1.1 menghasilkan audio dan dialog?
Ya, suara digenerate dalam satu proses bersama gambar: dialog dengan lip sync, efek, ambience, dan musik yang pas dengan aksinya. Tulis audio yang Anda mau di dalam prompt, karena kalau prompt tidak menyebut soal suara, model akan mengarang treknya sendiri. Untuk dialog, cukup tuliskan kalimat yang diucapkan karakternya.
Bisakah saya memakai Gemini Omni Flash 1.1 di Morphic?
Bisa. Pilih Gemini Omni di pemilih model video, tulis shotnya lengkap dengan suara yang Anda mau, lalu generate. Hasilnya mendarat di Canvas, bersebelahan dengan hasil Veo, Seedance, dan Kling untuk dibandingkan langsung. Prompt lanjutan mengedit adegan yang sama, dan gambar referensi bisa ikut disertakan bersama briefnya.
Apakah Gemini Omni Flash 1.1 sama dengan Veo 4?
Bukan, dan kebingungannya wajar: keduanya datang dari Google DeepMind, dan Omni sering ditulis sebagai penerus lini Veo. Keduanya model terpisah. Veo adalah keluarga video sinematik, sekarang di Veo 3.1; Gemini Omni adalah keluarga multimodal yang model videonya pertama kali muncul sebagai Omni Flash, kini di versi 1.1. Google belum pernah merilis model bernama Veo 4, jadi setiap sebutan “Veo 4” adalah spekulasi atau julukan informal untuk Omni.
Apa bedanya Gemini Omni Flash 1.1 dengan Veo 3.1?
Veo 3.1 disetel untuk kualitas sinematik dalam satu shot; Omni Flash 1.1 disetel untuk iterasi. Omni adalah model yang Anda arahkan: ia mengedit outputnya sendiri giliran demi giliran, menerima campuran referensi gambar dan video, memperpanjang take sampai 40 detik, dan menjaga karakter beserta suaranya sepanjang proses. Untuk satu hero shot sekali jadi, Veo masih unggul di kehalusan; untuk adegan yang Anda perbaiki dan tumbuhkan, Omni Flash adalah alurnya.