IndoTrik - Perkembangan AI video semakin cepat. Salah satu teknologi yang menarik perhatian adalah Google Veo, model generatif video dari Google yang dapat mengubah instruksi teks dan gambar menjadi video dengan tampilan sinematik.
Generasi terbaru yang tersedia saat ini adalah Veo 3.1. Model ini membawa peningkatan pada kualitas visual, kepatuhan terhadap prompt, konsistensi karakter dan objek, serta kemampuan audio. Veo 3.1 juga dapat digunakan melalui beberapa produk Google seperti Gemini, Flow, Gemini API, Vertex AI, dan Google Vids.
Veo 3.1 merupakan model generatif video Google yang dirancang untuk membuat video dari instruksi pengguna. Selain text-to-video, kemampuan Veo juga mencakup penggunaan gambar sebagai referensi dan berbagai alur kerja kreatif melalui Google Flow.
Google mengembangkan Veo untuk menghasilkan video yang lebih realistis dengan kontrol kreatif yang lebih baik. Pada Veo 3.1, peningkatan juga diberikan pada detail visual, pemahaman prompt, serta audio yang dihasilkan bersama video.
Veo dapat membuat video berdasarkan deskripsi teks. Pengguna cukup menjelaskan subjek, aktivitas, lingkungan, kamera, pencahayaan, gaya visual, dan elemen lain yang diinginkan.
Semakin jelas prompt yang diberikan, semakin mudah model memahami adegan yang ingin dibuat. Google sendiri menyarankan untuk menjelaskan subjek dan aksi secara detail ketika membuat video menggunakan Flow.
Selain teks, pengguna dapat menggunakan gambar sebagai bahan untuk membuat video. Flow mendukung alur Frames to Video, termasuk penggunaan frame awal dan pada model tertentu frame awal serta frame akhir untuk membantu mengarahkan transisi adegan.
Veo 3.1 juga mendukung penggunaan beberapa gambar referensi melalui fitur Ingredients to Video. Fitur ini berguna ketika pengguna ingin mempertahankan karakter, objek, atau gaya visual tertentu dalam sebuah adegan.
Salah satu kemampuan penting Veo 3 adalah menghasilkan video sekaligus audio. Veo 3.1 kemudian memperluas kemampuan tersebut ke lebih banyak fitur di Flow.
Audio dapat digunakan untuk membangun suasana adegan, efek suara, dan dialog sesuai dengan instruksi yang diberikan. Google juga menyebut peningkatan pada audio dan kualitas audiovisual sebagai bagian dari pengembangan Veo 3.1.
Dalam pembuatan video AI, menjaga karakter atau objek tetap konsisten dari satu adegan ke adegan lain merupakan tantangan tersendiri.
Veo 3.1 melalui fitur Ingredients to Video memungkinkan pengguna memberikan beberapa gambar referensi untuk membantu mengarahkan karakter, objek, dan gaya visual yang digunakan dalam video.
Veo 3.1 juga mendukung pembuatan video vertikal. Fitur ini berguna bagi kreator yang membuat konten untuk platform seperti YouTube Shorts dan format video pendek lainnya.
Google memperkenalkan dukungan video vertikal pada pembaruan Veo 3.1 dan juga menyebut kemampuan membuat video dari gambar langsung melalui aplikasi Gemini.
Jangan menyamakan kemampuan Veo dengan anggapan bahwa setiap video otomatis dibuat dalam resolusi 1080p atau 4K. Resolusi akhir bergantung pada model dan fitur yang digunakan.
Google Flow saat ini menyediakan opsi peningkatan resolusi hingga 1080p untuk paket tertentu dan hingga 4K untuk pelanggan Google AI Ultra.
Durasi video bergantung pada model yang digunakan. Di Google Flow, Veo 3.1 Lite mendukung klip 4, 6, dan 8 detik, sedangkan Veo 3.1 Fast mendukung 4, 6, 8, dan 10 detik pada fitur yang sesuai.
Video yang lebih panjang tidak berarti Veo menghasilkan satu klip berdurasi satu menit secara langsung. Flow menyediakan fitur Extend untuk melanjutkan klip sehingga beberapa potongan dapat disambungkan menjadi adegan yang lebih panjang.
Salah satu cara yang menarik untuk menggunakan Veo adalah melalui Google Flow, alat AI filmmaking Google yang menyediakan berbagai model Veo dan fitur untuk menyusun beberapa klip menjadi sebuah adegan.
Google menyarankan penggunaan komputer dengan browser berbasis Chromium untuk pengalaman Flow yang paling lengkap, meskipun Flow juga tersedia melalui perangkat lain dan aplikasi Android di wilayah yang didukung.
Ketentuan akses dan sistem kredit Google Flow dapat berubah. Saat ini, Google menyediakan 50 kredit Flow gratis per hari bagi pengguna yang bukan pelanggan Google AI Plus, Pro, atau Ultra. Kredit tersebut dapat digunakan untuk generasi tertentu menggunakan model Veo 3.1 yang didukung.
Pengguna paket Google AI juga mendapatkan alokasi kredit sesuai paket yang digunakan. Biaya kredit berbeda berdasarkan model dan jenis generasi, sehingga sebaiknya periksa jumlah kredit yang ditampilkan di Flow sebelum melakukan proses generate.
Google menyatakan bahwa pengguna Flow harus memenuhi persyaratan tertentu, termasuk usia minimal 18 tahun yang telah diverifikasi, berada di wilayah yang didukung, dan memiliki paket yang memenuhi syarat seperti Google AI Plus, Pro, atau Ultra. Google juga mencantumkan beberapa paket Workspace yang memenuhi syarat.
Karena ketersediaan layanan dapat berbeda berdasarkan negara dan jenis akun, pengguna sebaiknya memeriksa halaman resmi Flow sebelum mengandalkan fitur tertentu.
Untuk mendapatkan hasil yang lebih terarah, jangan hanya menulis prompt seperti “buat video kota Tokyo”. Jelaskan subjek, aksi, lingkungan, kamera, pencahayaan, dan suasana.
Contohnya:
“Cinematic night scene in Tokyo during heavy rain, a young man walking through a crowded neon-lit street, reflections on wet pavement, realistic handheld camera movement, shallow depth of field, natural facial expressions, dramatic blue and red lighting, realistic ambient city sounds and rain.”
Prompt yang lebih terperinci memberi model lebih banyak informasi mengenai adegan yang diinginkan. Google juga menyarankan menjelaskan subjek dan aksi secara jelas serta menggunakan Gemini untuk membantu menyempurnakan prompt jika diperlukan.
| Fitur | Veo 3 | Veo 3.1 |
|---|---|---|
| Generasi video AI | Ya | Ya |
| Audio generatif | Ya | Ya, dengan peningkatan |
| Kontrol prompt | Baik | Lebih ditingkatkan |
| Ingredients to Video | Didukung dalam alur tertentu | Didukung dengan peningkatan kontrol |
| Frame to Video | Didukung | Didukung dengan kemampuan yang lebih luas |
| Extend | Didukung dalam produk tertentu | Didukung di Flow |
| Video vertikal | Terbatas tergantung produk | Didukung |
Veo 3.1 pada dasarnya merupakan pengembangan dari Veo 3 dengan peningkatan pada realisme, audio, kontrol naratif, dan kemampuan menggunakan referensi untuk menjaga konsistensi visual.
Bisa untuk membangun video yang lebih panjang melalui beberapa klip, tetapi jangan menganggapnya sebagai generator yang langsung menghasilkan film berdurasi beberapa menit dalam satu proses.
Workflow yang lebih masuk akal adalah membuat beberapa klip pendek, menjaga karakter dan lingkungan tetap konsisten menggunakan referensi, kemudian menyusunnya menjadi sebuah adegan menggunakan fitur editing dan Scenebuilder di Flow.
Google Veo telah berkembang jauh dari sekadar generator video berbasis teks. Dengan Veo 3.1, pengguna mendapatkan kombinasi generasi video, audio, referensi visual, kontrol frame, video vertikal, serta fitur editing melalui Flow.
Bagi kreator konten, teknologi seperti ini dapat mempercepat proses pembuatan visual tanpa harus selalu melakukan proses shooting secara konvensional. Namun, hasil terbaik tetap membutuhkan prompt yang baik, pemilihan model yang tepat, dan proses editing setelah video dibuat.
Kalau sebelumnya AI video hanya menarik untuk eksperimen, Veo 3.1 sekarang sudah jauh lebih dekat dengan workflow produksi konten yang sebenarnya.
(0)