Sekarang Lo Bisa Kasih Arahan Kamera ke Model Video AI Google!

Veo 2 udah bisa otomatis ngehapus objek, ngelebarin video, dan nambahin preset gaya sinematik.

Kalau lo pikir Google cuma main-main di dunia AI, pikir lagi deh! Google lagi berusaha bikin model video AI mereka, Veo 2, lebih gampang dipake buat bikin konten yang keliatan sinematik dan ngedit footage asli. Fitur baru Veo 2 ini udah bisa dicoba lewat platform Vertex AI-nya Google Cloud, bareng update lain yang ngeimprove generator gambar dari teks, Imagen 3, dan model AI yang berhubungan sama audio.

Fitur Baru yang Bikin Ngiler

Fitur baru Veo 2 termasuk inpainting, yang bisa otomatis ngehapus “gambar background yang nggak diinginkan, logo, atau gangguan dari video lo” kata Google, dan outpainting, yang memperluas frame video asli ke format yang berbeda. Tool yang terakhir ini bakal ngisi ruang kosong dengan footage video AI-generated yang ngeblend sama clip aslinya, mirip kayak fitur Generative Expand-nya Adobe buat gambar.

Ketika Veo 2 memperluas video melebihi batas aslinya, ruang kosong diisi dengan footage yang dihasilkan AI supaya nyambung. GIF: Google

Update ini juga bikin pengguna Veo 2 bisa milih preset teknik sinematik buat disertain sama deskripsi teks mereka pas generate footage. Preset ini bisa bantu ngarahin komposisi shot, sudut kamera, dan pacing di hasil akhir. Contoh presetnya termasuk efek timelapse, POV gaya drone, dan simulasi camera-panning ke berbagai arah.

Fitur baru interpolasi juga udah ditambahin yang bisa bikin transisi video di antara dua gambar diam, dengan ngisi urutan awal dan akhir pake frame baru.

Saingan Berat

Model video Firefly dari Adobe punya kemampuan yang mirip, dengan fitur AI generatif untuk memperluas video yang baru diluncurin di Premiere Pro minggu lalu. Google juga nambahin watermark atribusi digital SynthID ke output AI-generated mereka, mirip sama sistem Content Credentials-nya Adobe, tapi Adobe lebih maju lagi dengan jaminan bahwa tool mereka aman komersial sepenuhnya karena dilatih pake konten berlisensi dan domain publik — sesuatu yang nggak bisa ditandingin Google yang udah “nelen” isi web buat ngelatih model AI mereka.

Peningkatan di Imagen 3 Juga

Kemampuan editing di model text-to-image Google, Imagen 3, juga udah diupdate buat “secara signifikan” meningkatkan penghapusan objek otomatis, menurut Google. Katanya sih bakal ngasih hasil yang lebih natural pas ngehapus gangguan. Veo 2 dan Imagen 3 udah dipake sama perusahaan-perusahaan kayak L’Oreal dan Kraft Heinz buat produksi konten marketing, dengan pemimpin pengalaman digital Kraft Heinz, Justin Thomas, yang bilang jenis tugas yang “dulu butuh delapan minggu sekarang cuma butuh delapan jam.”

Update Audio Juga Gak Kalah Keren

Di sisi audio, Google udah merilis model text-to-music mereka, Lyria, dalam preview private dan meluncurkan fitur “Instant Custom Voice” untuk model pidato sintetis mereka, Chirp 3. Google bilang bahwa Chirp 3 sekarang bisa menghasilkan “suara kustom realistis dari input audio 10 detik,” dan fitur transkripsi baru juga diluncurin dalam preview yang bisa mengidentifikasi dan memisahkan speaker individual untuk memberikan transkripsi yang lebih jelas untuk panggilan dengan banyak orang yang bicara.

Masih Banyak Lagi!

Update-update ini cuma sebagian kecil dari pengumuman terkait AI yang dibuat Google hari ini. Gemini 2.5 Flash, versi terbaru dari model Flash yang dioptimalkan untuk efisiensi, bakal segera tersedia di Vertex AI. Google bilang Gemini 2.5 Flash “secara otomatis menyesuaikan waktu pemrosesan” berdasarkan kompleksitas tugas untuk memberikan hasil lebih cepat untuk permintaan sederhana.

Google juga mengupdate tool Agentic AI mereka yang fokus di enterprise minggu ini buat ngizinin agen AI saling berkomunikasi dan melakukan tugas di platform kayak PayPal dan Salesforce. Sementara itu, bagian baru diluncurkan di Google Cloud Marketplace buat perusahaan-perusahaan yang mau browse dan beli agen AI yang dibangun oleh partner Google pihak ketiga.