Panduan lengkap Grok Imagine Video 1.5: prompt dan fitur

Panduan lengkap Grok Imagine Video 1.5: prompt dan fitur

Panduan lengkap Grok Imagine Video 1.5 di Morphic: praktik terbaik, panduan prompt dengan contoh, fitur dan contoh penggunaan, serta spesifikasi teknis.

Fitur dan kemampuan Grok Imagine Video 1.5

FiturYang dilakukanPaling cocok untuk
Audio tersinkronisasi nativeDialog, efek, ambience, dan musik dihasilkan bersama gerakan, dalam sinkronTalking head, iklan produk, klip musik
Animasikan gambar diamMengubah gambar diam jadi gerak sambil menjaga cahaya, warna, dan teksturnyaFoto, foto produk, karya seni
Perpanjangan videoMelanjutkan dari frame terakhir menjadi urutan yang lebih panjangUrutan cerita, beat yang lebih panjang
Generasi berpandu referensiMenjaga karakter atau gaya tetap konsisten di berbagai klip lewat gambar referensiKarakter konsisten, seri dengan gaya terkunci
Pengikutan prompt + kontrol kameraJenis shot, gerakan kamera, dan cue timing muncul sesuai yang ditulisPreview storyboard, shot presisi

Audio tersinkronisasi native

Audio dihasilkan bersamaan dengan video dalam satu proses: dialog dengan lip-sync, efek suara, ambience latar, dan musik. Anda mendeskripsikan suara dalam prompt yang sama dengan gerakannya, jadi tidak ada langkah audio terpisah.

Animasikan gambar diam

Gambar yang Anda unggah dipakai sebagai frame pertama, dan model mengembangkan gerakan dari sana. Pencahayaan, warna, dan detail asli dipertahankan, bukan dihasilkan ulang, yang cocok untuk menganimasikan foto, foto produk, atau karya seni yang sudah jadi.

Gambar diam yang dipakai sebagai frame awal untuk Grok Imagine Video 1.5
Gambar awalnya.

Perpanjangan video

Klip yang sudah ada bisa dilanjutkan dari frame terakhirnya untuk membuat shot yang lebih panjang, dengan subjek, pencahayaan, dan gerakan yang tetap sama. Ulangi langkah ini untuk membangun urutan multi-bagian dari satu klip awal.

Frame terakhir klip pertama, tempat perpanjangan video melanjutkan
Frame terakhir tempat perpanjangan melanjutkan.

Generasi berpandu referensi

Gambar referensi mengarahkan gaya dan karakter tanpa mengunci frame pertama. Model membawa tampilan itu ke shot baru, sehingga karakter atau gaya visual tetap konsisten di berbagai generasi terpisah.

Gambar referensi yang mengarahkan karakter dan gaya untuk Grok Imagine Video 1.5
Gambar referensinya.

Pengikutan prompt dan kontrol kamera yang kuat

Model mengikuti arahan detail, termasuk jenis shot, gerakan kamera spesifik seperti dolly atau pan, dan timing kapan sebuah aksi terjadi. Ini membuat shot yang sudah direncanakan lebih mudah direproduksi sesuai keinginan.

Spesifikasi teknis Grok Imagine Video 1.5

SpesifikasiGrok Imagine Video 1.5
ProviderxAI
ModeImage-to-video, text-to-video, reference-to-video, editing video, perpanjangan video
AudioNative, tersinkronisasi (dialog, efek, ambience, musik)
Resolusi480p atau 720p
Durasi1 sampai 15 detik
Frame rate24 fps
Rasio aspek16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 1:1

Cara memaksimalkan Grok Imagine Video 1.5

Model ini memberi hasil terbaik saat Anda mulai dari frame yang kuat dan brief yang jelas serta fokus pada gerakan. Beberapa praktik ini membawa sebagian besar kualitas hasil:

  • Mulai dari gambar diam. Hasilkan atau lampirkan gambar 16:9 lebih dulu, baru animasikan. Frame pertama yang bagus adalah pengungkit tunggal terbesar untuk hasilnya.
  • Buat prompt gerakan singkat dan spesifik. Sebutkan aksinya dan satu gerakan kamera; biarkan gambar yang membawa komposisi dan gaya.
  • Selalu sebutkan audionya. Dialog, efek suara, ambience, atau musik, dalam bahasa yang jelas, supaya model menghasilkan suara bersama gerakan alih-alih klip bisu.
  • Satu aksi per klip. Padatkan satu beat dalam beberapa detik dan pakai perpanjangan video untuk urutan yang lebih panjang.
  • Untuk karakter yang berbicara, pakai potret menghadap depan dengan mulut masuk frame dan jaga dialog tetap singkat untuk lip-sync yang bersih.
  • Pakai gambar referensi saat sebuah tampilan atau karakter harus tetap konsisten di berbagai klip.

Panduan prompt Grok Imagine Video 1.5

Prompt yang kuat terasa seperti brief shot singkat, bukan caption. Dua hal yang menentukan hasilnya: daftar jelas apa yang ada di frame, dan kata-kata yang konkret alih-alih samar.

Apa yang masuk dalam prompt

ElemenApa yang disertakanContoh
SubjekSiapa atau apa yang ada di frame, dijelaskan secara konkretseorang presenter berkemeja sweater abu-abu tua
GerakanApa yang bergerak, dan bagaimanadia tersenyum dan menatap kamera
KameraJenis shot plus satu gerakanmedium shot, push-in perlahan
AudioDialog, efek, ambience, atau musikdia berkata, 'Selamat datang'; room tone yang lembut
DurasiPanjang klip dan rasio aspek5 detik, 16:9

Prompt lemah vs kuat

Sebutkan kameranya, gerakan dan timingnya, serta audionya, alih-alih membiarkannya jadi kebetulan.

FokusLemahKuat
KameraSeorang wanita di kota pada malam hariHandheld tracking shot mengikuti seorang wanita menyusuri jalanan basah hujan, pantulan neon, depth of field dangkal
Gerakan dan timingPintu terbuka dan seseorang masukPintu terbuka perlahan, sebuah sosok melangkah masuk setelah jeda sesaat, lalu kamera stabil
AudioSeorang koki menata hidanganClose-up seorang koki menata hidangan, uap mengepul. Audio: suara sizzle wajan, ambience dapur yang lembut, dan 'Service.'

Pengaturan yang perlu diketahui

PengaturanCatatan
Durasi1 sampai 15 detik; jaga satu aksi per klip
Resolusi480p atau 720p
Rasio aspekMengikuti gambar input Anda, atau atur 16:9, 9:16, atau 1:1
Gambar referensiTambahkan untuk menjaga gaya atau karakter tetap konsisten di berbagai klip
Urutan lebih panjangPakai perpanjangan video untuk melanjutkan dari frame terakhir

Kesalahan umum

  • Membiarkan prompt bisu: selalu tulis minimal satu cue suara.
  • Kamera samar: "sinematik" tidak memberi tahu model apa pun; sebutkan jenis shot dan gerakannya.
  • Terlalu banyak dalam satu klip: satu aksi per klip, lalu perpanjang.

FAQ

Bagaimana cara mendapatkan hasil terbaik dari Grok Imagine Video 1.5?

Mulai dari gambar diam 16:9 yang kuat, buat prompt gerakan singkat dan spesifik, sebutkan satu gerakan kamera, dan selalu sertakan cue audio. Jaga satu aksi per klip dan pakai perpanjangan video untuk urutan yang lebih panjang.

Apakah Grok Imagine Video 1.5 menghasilkan audio?

Ya. Audio dihasilkan secara native bersama video dan tetap sinkron dengan gerakannya. Satu generasi bisa mencakup dialog dengan lip-sync, efek suara, ambience, dan musik, tanpa proses audio terpisah.

Input apa saja yang bisa dipakai Grok Imagine Video 1.5?

Sebuah gambar plus prompt teks untuk image-to-video, atau prompt teks saja untuk text-to-video. Anda juga bisa menyertakan gambar referensi untuk mengarahkan gaya dan karakter, serta melanjutkan atau memodifikasi klip yang sudah ada lewat perpanjangan video dan editing.

Berapa lama klip Grok Imagine Video 1.5 dan resolusi berapa yang didukung?

Klip berdurasi 1 sampai 15 detik pada 480p atau 720p, 24 fps. Untuk image-to-video, rasio aspek mengikuti gambar input Anda, dan Anda bisa mengatur rasio untuk hasil landscape, persegi, atau vertikal.

Apa beda Grok Imagine Video 1.5 dengan Grok Imagine versi awal?

Grok Imagine versi awal adalah model cross-modal xAI yang mencakup text-to-image, edit gambar, dan beberapa jalur video. Grok Imagine Video 1.5 adalah rilis video khusus, disetel untuk image-to-video dengan audio tersinkronisasi native, dialog ber-lip-sync, dan perpanjangan video.