MOMSMONEY.ID - Cara AI membuat video telah berkembang dari sekadar demo menjadi alat yang siap pakai dalam bidang pemasaran, penjualan dan pelatihan. Generator video AI mengubah teks, gambar, atau keduanya menjadi rekaman video dengan cara menghilangkan noise acak hingga membentuk klip.
Ben L, pengamat media sosial dari Snapbar.com, memaparkan, model image to video menggunakan gambar diam sebagai acuan. Model ini melakukan prediksi berdasarkan informasi yang dipelajari, bukan merekam objek asli.
AI membuat video melalui tiga tahap yakni mengodekan input menjadi angka yang dapat diproses oleh model, menjalankan proses difusi yang mengubah noise acak menjadi urutan frame, renderring hasilnya menjadi berkas dengan resolusi, frame rate, dan codec yang tepat.
Baca Juga: Resmi Masuk ke Indonesia, Plaud Perkenalkan Solusi Transkrip AI ke Berbagai Bahasa
Berikut ini cara AI membuat video yang penting untuk dipahami:
1. Pengodean input
Prompt teks dipecah dan diubah menjadi embedding. Gambar diproses melalui vision encoder, video referensi diambil sampelnya menjadi frame-frame yang mewakili keseluruhan video.
2. Difusi noise menjadi video
Dimulai dari noise murni, model berulang kali memprediksi versi yang memiliki tingkat noise lebih rendah berdasarkan input pengguna. Proses ini diulang berkali-kali hingga terbentuk klip yang koheren.
Hal ini adalah teknik difusi gambar yang diperluas lintas waktu, sehingga setiap frame memiliki keterkaitan satu sama lain.
3. Rendering dan pasca-pemrosesan
Hasil akhir dibersihkan dari noise menjadi berkas video, terkadang setelah melalui proses penghalusan gerakan, koreksi warna, atau peningkatan resolusi. Audio juga diproses pada tahap ini, banyak model terkini menghasilkan suara secara langsung.
Sementara, yang lain menambahkan lapisan musik atau trek suara setelahnya. Dalam aktivasi Snapbar, tahap ini juga menjadi momen di mana intro, outro, dan soundtrack bermerek digabungkan ke dalam satu berkas utuh.
Bagaimana cara kerja generator image to video?
Generator image to video bekerja dengan memasukkan gambar ke dalam model sebagai conditioning signal dan menggantikan deskripsi teks. Sehingga, subjek sudah ditetapkan sebelum gerakan dihasilkan.
Model memprediksi bagaimana frame spesifik tersebut harus bergerak alih-alih menciptakan adegan baru dari kata-kata. Model video menerima gambar masukan sebagai pemandu, embedding teks diganti dengan embedding dan gambar disalin di sepanjang Time Axis sebagai titik awal untuk setiap bingkai.
Baca Juga: Era AI, Pekerja Perlu Terus Asah Keahlian agar Tetap Relevan
Apa saja jenis-jenis generator video AI?
Jenis utama generator video AI meliputi text to video, image to video, presenter berbasis avatar, dan aktivasi acara langsung yang menghubungkan potret AI ke dalam model image to video. Text to video menggunakan prompt, lalu model membuat klip dari awal.
Runway, Sora dari OpenAI, dan Veo dari Google bekerja dengan cara ini. Demikian cara AI membuat video yang bisa digunakan untuk branding maupun peluncuran produk baru.
Cek Berita dan Artikel yang lain di Google News