Dibuat dengan aplikasi ini
Gemini Omni Flash 1.1 adalah model video multimodal Google, tersedia di sini sebagai aplikasi terfokus untuk menghasilkan dan mengedit video bentuk pendek. Model ini menerima masukan berupa teks, gambar diam, bingkai akhir opsional, hingga sepuluh gambar referensi, atau tiga klip referensi, dan dapat mengedit video yang sudah ada berdasarkan instruksi bahasa alami. Output berjalan dari 360p hingga 4K dengan durasi tiga hingga sepuluh detik, dengan audio tersinkronisasi asli yang tertanam. Cocok untuk kreator, pemasar, dan pengembang yang membutuhkan kontinuitas visual presisi, teks yang terbaca di layar, dan audio berkualitas tanpa tahap suara terpisah.
Cara menggunakan aplikasi ini
- 1
Jelaskan apa yang ingin Anda buat, atau unggah file sumber Anda.
- 2
Pilih opsi Anda, lalu tekan Hasilkan.
- 3
Lihat hasil Anda muncul di galeri dalam beberapa saat.
- 4
Unduh, bagikan, atau hasilkan lagi dengan ide baru.
Apa yang bisa Anda buat
Tampilan Produk Dekat dengan Audio
Jelaskan produk, sediakan foto diam sebagai bingkai awal, dan biarkan model menganimasinya pada 4K dengan audio ambien tersinkronisasi atau gaya voice-over. Pengetahuan dunia model membuat label dan teks pada kemasan tetap terbaca di setiap bingkai, menghilangkan titik nyeri umum dalam video produk AI.
Kontinuitas Karakter Berdasarkan Referensi
Unggah hingga sepuluh gambar referensi karakter atau lokasi untuk mengarahkan generasi. Gemini Omni Flash 1.1 mempertahankan identitas visual yang konsisten di seluruh potongan, menjadikannya praktis untuk urutan gaya storyboard, maskot bermerek, atau pengaturan adegan berulang yang harus terlihat sama dari satu pengambilan ke pengambilan berikutnya.
Mengedit Klip yang Ada Berdasarkan Instruksi
Masukkan video sumber dan ketik instruksi pengeditan bahasa alami seperti 'buat langit mendung' atau 'hapus kekacauan latar belakang.' Model menerapkan perubahan tanpa tahap komposisi terpisah, berguna untuk putaran revisi cepat pada footage yang sebaliknya sudah selesai.
Grafis Gerak Overlay Teks
Karena model ini didasarkan pada pengetahuan dunia Gemini, teks di layar ditampilkan dengan benar dan tetap tajam melalui gerakan. Gunakan ini untuk judul kinetik, lower-third, atau callout data di mana model generatif lain biasanya menghasilkan letterform yang kacau atau melayang.
Cerita Gambar-ke-Video
Sediakan gambar awal dan bingkai akhir opsional untuk menentukan momen pertama dan terakhir adegan, lalu biarkan model menginterpolasi aksi di antaranya. Ini berfungsi baik untuk presentasi konsep, animatik, dan pitch deck di mana Anda membutuhkan gerakan terkontrol dari karya seni statis.
Ide prompt untuk dicoba
Mengapa kreator menggunakan aplikasi ini
- Audio tersinkronisasi asli
- Output 360p hingga 4K
- Durasi 3-10 detik
- Input Teks, Gambar dan Referensi
- Pengarahan Video Referensi
- Edit Video dengan Instruksi
Tips untuk hasil yang lebih baik
Jangkar Teks dengan Masukan
Ketika video Anda membutuhkan kata-kata yang terbaca, tuliskan dengan tepat dalam masukan. Gemini Omni Flash 1.1 didasarkan pada pengetahuan dunia, yang memberikannya keunggulan dalam akurasi letterform, tetapi masukan eksplisit masih mengurangi pergeseran dan memastikan model memprioritaskan elemen tersebut.
Gunakan Bingkai Akhir untuk Kontrol
Menyediakan gambar awal dan bingkai akhir memberikan model dua jangkar untuk diinterpolasi. Ini adalah cara paling andal untuk mengontrol busur dan komposisi ketika Anda membutuhkan payoff visual tertentu di kesimpulan klip daripada gerakan terbuka.
Lapisi Masukan Referensi Secara Strategis
Model menerima hingga sepuluh gambar referensi dan tiga klip referensi secara bersamaan. Gunakan slot gambar untuk konsistensi karakter atau objek dan slot klip untuk menentukan gaya gerakan atau perilaku kamera. Mencampur kedua jenis masukan dalam satu generasi memberikan Anda pengarahan yang lebih halus daripada salah satu saja.
Tulis Instruksi Pengeditan dengan Presisi
Saat menggunakan mode pengeditan video, jelaskan apa yang akan diubah dan apa yang akan dipertahankan dalam instruksi yang sama. Frasa seperti 'ubah warna dinding menjadi teal dalam, pertahankan furnitur dan pencahayaan identik' jauh lebih efektif daripada arahan yang samar, karena menetapkan batasan eksplisit pada pengeditan dan elemen yang tidak disentuh.
Kapan memilih aplikasi ini
Pilih aplikasi ini ketika prioritas Anda adalah resolusi 4K dengan audio tersinkronisasi asli dari satu lintasan generasi, kontinuitas visual terkontrol referensi di seluruh aset berganda, teks yang terbaca di layar, atau kemampuan untuk mengedit klip yang ada melalui instruksi yang diketik. Seedance 2.5 mencakup lintasan lebih lama hingga 30 detik dan menerima jauh lebih banyak materi referensi, yang merupakan kecocokan lebih baik ketika durasi atau kedalaman referensi lebih penting daripada tingkat resolusi. Wan 3.0 menawarkan video lintasan tunggal 30 detik dengan omni-referensi, menjadikannya pilihan yang lebih kuat untuk adegan yang diperpanjang. Gemini Omni Flash 1.1 adalah pilihan yang tepat ketika Anda membutuhkan resolusi output tertinggi dari ketiganya, atau ingin merevisi klip yang ada dengan mengetik instruksi daripada meregenerasinya.
Pertanyaan yang sering diajukan
Bisakah saya menghasilkan video tanpa menyediakan gambar apa pun?
Ya. Aplikasi menerima masukan teks saja. Gambar, bingkai akhir, gambar referensi, dan klip referensi semuanya adalah masukan opsional. Anda hanya perlu menyediakannya ketika Anda ingin mengarahkan kontinuitas visual, menentukan titik akhir gerakan, atau mencocokkan karakter atau lokasi tertentu dengan materi sumber Anda.
Bagaimana audio tersinkronisasi asli bekerja dalam output?
Gemini Omni Flash 1.1 menghasilkan audio sebagai bagian dari lintasan model yang sama yang menghasilkan video, sehingga suara diselaraskan dengan visual daripada ditambahkan sebagai trek generik setelahnya. MP4 yang dihasilkan mencakup saluran audio yang sudah tertanam, siap digunakan tanpa tahap pencampuran terpisah.
Berapa jumlah maksimum masukan referensi yang dapat saya sediakan?
Anda dapat menyediakan hingga sepuluh gambar referensi dan hingga tiga klip video referensi dalam satu generasi. Masukan ini mengarahkan model menuju identitas visual yang konsisten untuk karakter, objek, lokasi, atau gaya gerakan kamera, tergantung pada apa yang digambarkan referensi.
Apakah mode pengeditan video berfungsi pada klip yang diunggah apa pun?
Mode pengeditan mengambil video yang ada sebagai sumber dan menerapkan instruksi bahasa alami untuk memodifikasinya. Model menafsirkan bahasa alami, jadi Anda tidak perlu menentukan parameter teknis. Hasil paling konsisten ketika instruksi dengan jelas menyatakan apa yang harus berubah dan apa yang harus tetap sama.
Resolusi apa yang harus saya pilih untuk pengiriman media sosial atau web?
Untuk sebagian besar platform media sosial, 1080p adalah default praktis karena menyeimbangkan kualitas visual dengan ukuran file dan persyaratan unggahan. Gunakan 4K ketika tujuan mendukungnya, seperti demo tampilan resolusi tinggi atau platform yang downsamples dengan anggun dari sumber yang lebih tinggi. 720p cocok untuk pratinjau atau draf. 360p berguna untuk iterasi cepat sebelum berkomitmen pada resolusi akhir.
Bagaimana cara saya menjaga karakter tetap konsisten di seluruh beberapa generasi terpisah?
Simpan gambar referensi Anda dari satu generasi dan sediakan sebagai masukan referensi di generasi berikutnya. Model menerima hingga sepuluh gambar referensi per lintasan, jadi Anda dapat menyertakan beberapa sudut atau ekspresi karakter yang sama untuk memperkuat konsistensi. Menggabungkan referensi gambar dengan masukan deskriptif yang menyebutkan fitur pembeda karakter meningkatkan koherensi lebih lanjut.
Model AI mana yang mendukung aplikasi ini?
Aplikasi ini berjalan pada Gemini Omni Flash 1.1, tersedia melalui Arteza tanpa akun atau setup terpisah.
Dapatkah saya menggunakan hasilnya secara komersial?
Ya. Konten yang Anda hasilkan adalah milik Anda untuk digunakan, sesuai dengan lisensi konten kami.
Berapa lama proses generasi?
Sebagian besar generasi selesai dalam waktu kurang dari satu menit, dan Anda dapat melihat progresnya secara langsung di galeri.