Panduan Lengkap Google Veo: Cara Membuat Video AI Bersuara dengan Veo 3.1 & Flow, Serta Panduan Berlangganan dan Penagihan

Google Veo 3.1 dapat menghasilkan video bersuara berdurasi 8 detik hingga 1080p dalam sekali jalan, dan dapat diperpanjang hingga lebih dari satu menit di Flow. Mulai dari langganan Google AI Pro seharga NT$650 di Taiwan, kami akan memandu Anda memahami sistem penagihan poin, penulisan prompt, hingga hal-hal penting untuk penggunaan komersial.

Pemilik toko kue kering di Taichung bulan lalu menerima penawaran harga dari sebuah perusahaan produksi video: video citra merek berdurasi 30 detik seharga 38.000 NTD. Putrinya merasa tidak terima, dan malam itu ia mengetik sebuah deskripsi menggunakan Google Flow—"Di atas meja kayu, tangan menyingkirkan kertas roti, kue kering mengepulkan uap panas, dengan latar belakang musik jazz yang lembut"—dan menghabiskan beberapa ratus poin langganan. Keesokan harinya, video tersebut sudah bisa diunggah ke halaman penggemar (fanpage) mereka. Kualitasnya tentu saja tidak bisa menandingi tim profesional, tetapi jumlah likes-nya empat kali lipat dari postingan biasanya.

Apa itu Google Veo

Veo adalah model pembuatan video yang dikembangkan oleh Google DeepMind. Versi aktif pada Juli 2026 adalah Veo 3.1, yang dibagi menjadi tiga spesifikasi: Standard (kualitas tinggi), Fast (cepat), dan Lite (ringan). Veo 3 dan Veo 2 yang lama telah resmi ditutup pada 30 Juni 2026. Keunggulan terbesar model ini adalah "audio asli (native audio)": dialog, suara latar, efek suara, dan gambar dihasilkan secara bersamaan serta diselaraskan secara otomatis tanpa perlu sulih suara (dubbing) setelahnya. Pembuatan tunggal menghasilkan durasi 8 detik dengan resolusi hingga 1080p (versi Standard pada API juga mendukung 4K). Jika dikombinasikan dengan fungsi perpanjangan (Extend) dari workspace video resmi, Flow, video ini dapat dirangkai menjadi video beruntun berdurasi lebih dari satu menit.

Terdapat tiga cara untuk mengaksesnya: memasukkan teks secara langsung untuk menghasilkan video di aplikasi Gemini, menggunakan workspace Flow di labs.google/flow (antarmuka storyboard dan penyuntingan untuk kreator), serta melalui Gemini API dan Vertex AI (untuk integrasi pengembang).

Apa Saja yang Bisa Dilakukan

  • Teks ke Video (Text-to-Video): Mengubah satu deskripsi teks menjadi klip pendek berdurasi 8 detik lengkap dengan audio, termasuk dialog dan efek suara.
  • Gambar ke Video (Frames to Video): Memberikan gambar bingkai pertama (first frame) atau dua gambar (awal dan akhir) untuk membuat foto statis menjadi bergerak.
  • Bahan ke Video (Ingredients to Video): Mengunggah beberapa gambar referensi untuk mempertahankan konsistensi wajah karakter, objek, dan gaya visual, guna mengatasi masalah lama di mana "pemeran utama selalu berganti wajah di setiap video".
  • Perpanjangan (Extend): Melanjutkan gerakan dari segmen sebelumnya untuk menghasilkan adegan berikutnya. Menurut pihak resmi, video dapat diperpanjang hingga lebih dari satu menit.
  • Manajemen Storyboard Flow: Menyusun, menghasilkan ulang, dan menggabungkan beberapa klip dalam satu proyek yang sama, seperti perangkat lunak penyuntingan video versi sederhana.

Cara Memulai (Langkah-langkah)

  1. Masuk ke Flow menggunakan akun Google. Buka labs.google/flow, akun dari Taiwan dapat langsung menggunakannya, dan akun baru biasanya mendapatkan sedikit poin gratis untuk mencoba.
  2. Pilih paket langganan. Harga di Taiwan: Google AI Plus seharga NT$260/bulan (pemula), Google AI Pro seharga NT$650/bulan. Paket Pro menyertakan 1.000 poin Flow setiap bulannya; bagi kreator berat, silakan lihat seri Ultra (pilihan 10.000 poin dan 25.000 poin).
  3. Buat proyek, masukkan prompt pertama. Tambahkan proyek baru di Flow, masukkan deskripsi adegan, pilih mode Fast terlebih dahulu untuk menghemat poin, dan beberapa versi kandidat akan dihasilkan sekaligus.
  4. Pilih salah satu untuk diperpanjang atau ditambahkan elemen. Klik tombol Extend pada klip yang disukai untuk melanjutkan ke adegan berikutnya, atau gunakan fitur Ingredients untuk mengunggah gambar referensi guna mengunci karakter, lalu hasilkan bidikan selanjutnya.
  5. Unduh dan lakukan pascaproduksi. Ekspor ke format MP4, masukkan ke alat penyuntingan seperti CapCut untuk menambahkan takarir (subtitle), melakukan color grading, dan menyematkan musik merek. Hasilnya adalah produk jadi yang siap diunggah.
  6. Pengembang menggunakan API. Jika ingin menghasilkan secara massal, integrasikan Gemini API: Veo 3.1 Fast dibanderol seharga US$0,10 per detik (720p), Standard US$0,40 per detik, dan Lite mulai dari US$0,05 per detik. Video Standard berdurasi 8 detik menelan biaya sekitar US$3,20, dan pembuatan yang gagal tidak akan dikenakan biaya.

Keahlian Tingkat Lanjut

Tulis prompt seperti naskah storyboard: Jangan hanya menulis "seorang wanita sedang minum kopi", melainkan tuliskan bahasa sinematiknya—"Close-up, kamera genggam perlahan mendekat, pencahayaan dari belakang (backlight) di dekat jendela, wanita tersebut menyesap kopi lalu tersenyum, dengan latar belakang suara uap mesin kopi." Mendeskripsikan sudut kamera, pencahayaan, dan efek suara secara terpisah akan jauh meningkatkan tingkat keberhasilan.

Tulis dialog langsung menggunakan tanda kutip: Jika ingin karakter berbicara, tuliskan dialog tersebut di dalam prompt, contohnya: Ia melihat ke arah kamera dan berkata, "Kue kering hari ini beli satu gratis satu." Veo 3.1 akan secara otomatis mencocokkan gerakan bibir dan mengisi suaranya.

Gunakan Fast untuk draf, Standard untuk hasil akhir: Terdapat perbedaan poin yang sangat besar antara kedua spesifikasi tersebut. Alur kerja saya pribadi adalah menggunakan mode Fast selama lima atau enam iterasi untuk menguji komposisi dan pergerakan kamera hingga puas, lalu menggunakan prompt yang sama namun beralih ke mode berkualitas tinggi untuk mengekspor versi final. Cara ini menghemat setidaknya setengah poin.

Gunakan Ingredients untuk menjaga konsistensi karakter: Untuk seri video, hasilkan terlebih dahulu foto karakter resmi yang memuaskan. Setelah itu, jadikan foto tersebut sebagai gambar referensi dan unggah di setiap pembuatan video berikutnya, agar maskot merek Anda tidak berubah wajah di setiap episodenya.

Hal-hal yang Perlu Perhatikan

  • Poin kedaluwarsa pada akhir bulan: Poin Flow tidak akan terakumulasi ke bulan berikutnya. Strategi menjadwalkan proyek besar di awal bulan dan menghabiskan sisa kuota di akhir bulan jauh lebih menguntungkan. Mode kualitas tinggi menghabiskan banyak poin dalam sekali jalan, jadi jumlah pemotongan poin yang aktual harus merujuk pada apa yang ditampilkan di antarmuka.
  • Biaya API dapat membengkak: US$0,40 per detik mungkin terdengar murah, tetapi melakukan iterasi sepuluh kali berarti US$32. Gunakan versi Lite atau Fast terlebih dahulu untuk memvalidasi prompt sebelum melakukan produksi massal.
  • Tanda air (watermark) dan identifikasi: Semua video yang dihasilkan Veo dilengkapi dengan tanda air tak terlihat SynthID yang tertanam di dalamnya. Mencoba menyamar sebagai rekaman video asli (live-action) tidak akan berhasil. Untuk materi pemasaran, disarankan untuk secara proaktif menandainya sebagai buatan AI, karena konsumen di Taiwan semakin sensitif terhadap hal ini.
  • Komersial dan hak potret: Ketentuan Google tidak mengeklaim kepemilikan atas konten yang dihasilkan, sehingga penggunaan komersial diperbolehkan, namun tanggung jawab atas pelanggaran ditanggung sendiri—jangan masukkan nama orang sungguhan, logo merek, atau karakter berhak cipta di dalam prompt. Menghasilkan video menggunakan wajah pesohor di Taiwan dapat melanggar hak potret sekaligus undang-undang perlindungan data pribadi.

Kesimpulan dan Ulasan TheAI學院

Jujur saja, batasan durasi 8 detik per segmen membuat Veo belum mampu menggantikan tim produksi video. Namun, kemampuan untuk "menghasilkan gambar dan suara secara bersamaan" saat ini masih dikejar oleh Sora, Runway, dan Kling AI. Bagi pemilik toko kecil dan kreator mandiri di Taiwan, berlangganan seharga NT$650 per bulan untuk mendapatkan kapasitas produksi video berdurasi pendek setiap hari adalah penawaran yang sangat menguntungkan. Jika ingin tahu bagaimana cara lain memanfaatkan video AI, Anda bisa membaca Panduan Alat Pembuatan Video AI kami, atau langsung menuju ke Pusat Tugas untuk mencari proses implementasi "Video Produk E-commerce".

Ulasan singkat: Saat ini merupakan model video yang paling mendekati konsep "ketik teks langsung jadi video bersuara", sangat layak bagi kreator video pendek untuk mencobanya selama satu bulan.

Sumber Data

Artikel ini disusun berdasarkan halaman penetapan harga resmi Google (one.google.com, ai.google.dev), blog resmi Google, dan dokumentasi instruksi Flow (diakses pada Juli 2026). Harga langganan, aturan poin, dan spesifikasi model dapat berubah sewaktu-waktu, harap merujuk pada pengumuman terbaru di situs web resmi Google.

Pertanyaan yang Sering Diajukan

Apakah Veo bisa digunakan secara gratis? Berapa biaya langganannya?

Akun baru yang masuk ke labs.google/flow biasanya mendapatkan sedikit poin gratis untuk uji coba, dan versi gratis aplikasi Gemini kadang menawarkan pengalaman terbatas. Untuk penggunaan yang stabil, Anda harus berlangganan: Google AI Plus di Taiwan seharga NT$260/bulan, Google AI Pro seharga NT$650/bulan (mendatangkan 1,000 poin Flow setiap bulan), dan tersedia juga seri paket Ultra bagi kreator berat.

Berapa durasi video yang dihasilkan Veo 3.1? Apakah bisa membuat video yang lebih panjang?

Sekali menghasilkan video berdurasi 8 detik dengan resolusi hingga 1080p serta sudah dilengkapi efek suara bawaan yang sinkron. Di dalam Flow, Anda bisa menggunakan fungsi Extend untuk melanjutkan gerakan dari klip sebelumnya. Menurut pihak resmi, fitur ini mampu membuat video berkelanjutan hingga lebih dari satu menit; untuk hasil yang lebih panjang, disarankan untuk membuatnya secara bertahap lalu menggabungkannya di aplikasi penyuntingan video.

Apakah video yang dihasilkan oleh Veo boleh digunakan secara komersial?

Boleh. Google tidak mengklaim kepemilikan atas konten yang dihasilkan, tetapi tanggung jawab atas pelanggaran hukum ditanggung oleh pengguna. Hindari penggunaan nama asli, merek dagang, atau karakter berhak cipta dalam prompt Anda; semua video telah disematkan tanda air tak kasat mata SynthID, dan untuk materi komersial, disarankan agar Anda secara proaktif memberi label "Buatan AI".

Bagaimana cara perhitungan biaya integrasi API Veo?

Melalui Gemini API, Veo 3.1 dikenakan biaya berdasarkan spesifikasi: Lite mulai dari US$0,05 per detik, Fast US$0,10 per detik (720p), dan Standard US$0,40 per detik (US$0,60 untuk 4K). Sebuah video Standard berdurasi 8 detik menelan biaya sekitar US$3,2, dan pembuatan yang gagal tidak akan dikenakan biaya.

繁體中文版 →