Gemini Omni Flash 1.1
oleh Google DeepMind
Model video Google: edit cukup Anda ketik.
Kini output 4K dan adegan sampai 40 detik.

Fitur utama
Spesifikasi teknis
Gemini Omni
Rilis Omni Flash kedua di keluarga Omni milik Google
5 tugas
Teks, gambar, referensi, edit, dan perpanjangan
3 sampai 10s
Per generasi; dengan extension, totalnya sampai 40 detik
Sampai 4K
360p dan 720p native, 1080p dan 4K hasil upscale
10 + 3
Sepuluh gambar plus tiga klip video, masing-masing maksimal 3 detik
Native
Dialog, efek suara, dan musik dalam satu proses
16:9, 9:16
Horizontal dan vertikal di semua resolusi
SynthID
Penanda asal tak terlihat di setiap klip yang dihasilkan
Contoh penggunaan

Edit yang cukup diketik
Berikan satu klip, sebutkan perubahannya: ganti cuaca, ubah jadi anime, tulis ulang papan namanya. Sisanya tetap utuh.

Karakter yang berbicara
Tulis kalimatnya dan karakter mengucapkannya dengan lip sync, dalam suara yang bertahan di tiap potongan dan tiap edit setelahnya.

Iklan yang setia referensi
Foto produk, foto presenter, dan klip tiga detik gerakan yang Anda mau jadi satu iklan, dengan produknya tetap akurat.

Adegan tumbuh jadi 40 detik
Buat beat pembukanya, lalu perpanjang sepuluh detik sekali jalan jadi adegan 40 detik dengan pemain, lokasi, dan musik yang sama.

Penjelasan dengan fisika
Gravitasi, cairan, dan tumbukan ikut aturan dunia nyata. Pemahaman Gemini soal sains dan sejarah menjaga detailnya tetap tepat.

Teks yang dirender di frame
Teks di layar kembali terbaca, dari lower third sampai papan nama toko, dan edit berikutnya bisa menulis ulang isinya.
Contoh prompt
Ikhtisar
Gemini Omni Flash 1.1 adalah rilis kedua model video multimodal Google DeepMind, dan yang pertama memberi ruang bagi sebuah shot untuk tumbuh. Satu generasi tetap berjalan 3 sampai 10 detik, lengkap dengan audio native. Bedanya, versi 1.1 membawa kontrol yang belum ada di rilis pertama: tangga resolusi dari draft 360p sampai pengiriman 4K, referensi video yang benar-benar mengarahkan hasil, opsi frame akhir yang mengubah dua gambar diam jadi satu gerakan, dan extension yang membawa klip sampai 40 detik tanpa kehilangan pemain atau musiknya.
Apa yang baru di Gemini Omni Flash 1.1
Omni Flash pertama merender semua klip di 720p dan berhenti di sepuluh detik. Versi 1.1 mempertahankan inti yang cepat dan responsif itu, lalu melepas batas-batas di sekelilingnya. Resolusi kini jadi pilihan di tiap generasi: 360p untuk iterasi murah, 1080p atau 4K saat take sudah siap dikirim. Input referensi tumbuh jadi sepuluh gambar plus tiga klip pendek, masing-masing diberi peran di prompt. Dan klip yang sudah jadi bukan lagi akhir dari cerita. Extension membaca potongan terakhir footage lalu melanjutkan adegannya, sepuluh detik sekali jalan, sampai empat kali panjang aslinya.
Edit lewat percakapan, bukan generate ulang
Kebanyakan model video memperlakukan prompt seperti tarikan mesin slot. Omni Flash memperlakukannya sebagai kalimat pembuka sebuah sesi. Model menjaga kondisi adegan antar giliran, jadi “make the jacket red”, “now extend the shot as she turns away”, dan “change the sign to say CLOSED” semuanya mendarat di take yang sama, dengan wajah, kostum, dan suara yang utuh. Instruksi contoh ditulis dalam bahasa Inggris, karena itu bahasa yang dievaluasi Google untuk model ini. Instruksi pendek dengan satu perubahan paling ampuh, dan bagian frame yang tidak pernah Anda sebut adalah bagian yang tidak bergeser.
Gemini Omni Flash 1.1 dan Morphic
Di Morphic, Gemini Omni duduk di pemilih model video bersama Veo 3.1, Seedance 2.5, Kling, dan sisa katalognya. Semuanya jalan di browser, tanpa instalasi dan tanpa GPU khusus. Tulis shotnya sebagai brief yang sudah memuat audio, lampirkan gambar referensi untuk apa pun yang harus tetap konsisten, lalu generate. Hasilnya mendarat di Canvas, tempat brief yang sama bisa dijalankan lewat model lain untuk dibandingkan berdampingan. Lanjutkan menyempurnakan di prompt berikutnya, satu perubahan sekali jalan, dan adegannya tetap membawa konteks dari giliran ke giliran.
Harga sederhana
Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.
Basic
1100 bulanan kredit
1 pengguna saja
Semua model
Workflows
Standard
3625 bulanan kredit
1 pengguna saja
Semua model
Workflows
Pro
6350 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Pro Max
24650 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Enterprise
Untuk batas yang lebih tinggi
Khusus
ketentuan harga dan penagihan

Free
Untuk bereksperimen
$0
gratis selamanya
FAQ
ChatGPT Images 2.5
OpenAI
Model gambar OpenAI, rilis September 2026. Detail lebih tajam, edit presisi, proses lebih cepat.
Lyria 3.5
Google DeepMind
Model musik terbaik dari Google. Lagu utuh: struktur, vokal, dan lirik.
MiniMax H3 Max Turbo
fal.ai
Tingkat cepat dari H3 racikan fal. Dua kali lebih gesit, tampilan mirip.
Inworld TTS 2
Inworld
95 suara, lebih dari 100 bahasa. Audio mulai di bawah satu detik.