Satu detik video 720p dari Gemini Omni 1.1 Flash berharga sekitar $0,10. Angka ini tercantum di halaman harga Google. Tidak ada tingkat gratis, jadi klip pertama yang Anda buat saat mengikuti dokumentasi akan ditagihkan ke akun Anda.
Hal yang menarik adalah model penagihannya berbasis token, bukan durasi. Setelah memahami mekanismenya, Anda bisa mengendalikan biaya dengan lebih baik—terutama dengan membuat draf pada 360p, yang dapat mengurangi biaya iterasi hingga dua pertiga.
Daftar harga
| Item | Harga |
|---|---|
| Masukan (teks, gambar, video, audio) | $1.50 per 1 juta token |
| Keluaran teks | $9.00 per 1 juta token |
| Keluaran video | $17.50 per 1 juta token |
| Tingkat gratis | Tidak ada |
Tarif ini berlaku untuk gemini-omni-1.1-flash, model GA yang dirilis pada 27 Agustus 2026, serta endpoint gemini-omni-flash-preview yang akan ditarik. Lihat fitur yang disertakan dalam rilis GA.
Bagaimana keluaran video menjadi token
Google menagih video seperti teks: berdasarkan token keluaran. Satu detik video 720p setara dengan 5.792 token keluaran.
5.792 token x ($17.50 / 1.000.000) = $0.1014 per detik
Artinya:
- Video 720p berdurasi 10 detik: sekitar $1.01
- Adegan 40 detik yang dibuat melalui empat panggilan ekstensi: sekitar $4.06
- Biaya tersebut belum termasuk token masukan untuk konteks sebelumnya pada setiap giliran
Masukan jauh lebih murah. Dengan tarif $1.50 per juta token, gambar referensi dan video lampiran biasanya tidak signifikan dibandingkan keluaran video.
Fokuskan optimasi pada durasi dan resolusi video, bukan panjang prompt.
Gunakan 360p untuk iterasi
Google menghasilkan pratinjau 360p dengan biaya sepertiga dari 720p dan hingga 60% lebih cepat. Draf 10 detik menjadi sekitar $0.34, bukan $1.01.
Iterasi prompt video jarang berhasil pada percobaan pertama. Sesi realistis bisa memerlukan 12 percobaan sebelum menghasilkan satu klip yang layak.
| Alur kerja | 12 draf | 1 render akhir | Total |
|---|---|---|---|
| Semuanya di 720p | $12.17 | $1.01 | $13.18 |
| Draf di 360p, final di 720p | $4.06 | $1.01 | $5.07 |
Dengan alur kedua, hasil akhirnya sama, tetapi pengeluaran berkurang 62%. Draf juga selesai lebih cepat.
Saat iterasi, atur resolution menjadi 360p di dalam response_format. Naikkan ke 720p hanya setelah prompt sudah tepat. Lihat panduan API untuk bentuk permintaannya.
Resolusi 1080p dan 4K merupakan upscale dari bingkai yang dihasilkan, bukan render asli. Tarifnya lebih tinggi daripada 720p. Sebelum menganggarkan pipeline 4K, periksa kembali biaya per detik terbaru di halaman harga Google.
Hitung biaya ekstensi adegan
Video 40 detik bukan satu permintaan. Biasanya alurnya terdiri dari:
- Satu generasi awal.
- Tiga panggilan ekstensi.
- Masing-masing panggilan menagih keluaran 10 detik dan konteks sebelumnya sebagai masukan.
Pada 720p, satu adegan 40 detik menghabiskan sekitar $4.06 untuk keluaran. Jika satu segmen rusak, Anda mungkin perlu membuat ulang mulai dari segmen tersebut.
Buat draf seluruh alur pada 360p terlebih dahulu dengan biaya sekitar $1.35. Pastikan cerita konsisten di keempat segmen, lalu render ulang pada resolusi final. Lihat panduan ekstensi adegan untuk mengetahui titik kegagalan yang umum.
Perbandingan dengan Veo 3.1
Kedua model menggunakan kunci API Gemini yang sama, sehingga perbedaan harga mudah terlewatkan.
| Model | 720p per detik | 4K per detik | Tingkat gratis |
|---|---|---|---|
| Gemini Omni 1.1 Flash | ~$0.10 | Tingkat upscale, lihat halaman harga | Tidak |
| Veo 3.1 | $0.40 | $0.60 | Tidak |
| Veo 3.1 Cepat | $0.10 | $0.30 | Tidak |
| Veo 3.1 Lite | $0.05 | Tidak tersedia | Tidak |
Veo 3.1 standar berharga sekitar empat kali lipat dari Omni per detik pada 720p. Veo 3.1 Lite lebih murah daripada Omni.
Namun, harga bukan satu-satunya pertimbangan:
- Veo menghasilkan audio asli.
- Veo dapat diperpanjang hingga 148 detik, dengan tambahan 7 detik setiap kali.
- Omni menyediakan loop edit percakapan yang tidak tersedia di Veo.
Baca perbandingan lengkap untuk menentukan model yang tepat untuk setiap pekerjaan. Jika Anda sudah menggunakan Veo, panduan integrasi tersebut masih berlaku.
Tiga sumber pemborosan biaya
1. Merender ulang pada resolusi penuh
Untuk memeriksa perubahan kecil pada prompt, gunakan draf 360p. Gunakan 720p hanya untuk versi yang akan dikirimkan.
2. Membuat ulang keluaran yang bisa di-cache
Keluaran video cukup deterministik untuk digunakan kembali. Dengan biaya sekitar $0.10 per detik, cache cepat mencapai titik impas.
Simpan file keluaran dan buat kunci cache dari:
- Prompt
- Resolusi
- Parameter lain yang digunakan
Membuat ulang klip yang sama dua kali adalah biaya yang tidak perlu.
3. Mencoba ulang timeout tanpa pemeriksaan
Pembuatan video membutuhkan waktu. Timeout pada sisi klien tidak selalu berarti proses generasi gagal. Retry otomatis dapat membuat Anda membayar dua kali untuk satu klip.
Untuk mencegahnya:
- Gunakan timeout yang realistis.
- Periksa interaksi yang sudah selesai sebelum melakukan retry.
- Simpan permintaan di Apidog.
- Validasi bentuk respons sebelum memasukkannya ke alur produksi.
- Atur peringatan pengeluaran di Google Cloud Billing.
Perkirakan tagihan bulanan
Mulai dari durasi video final, lalu tambahkan durasi draf berdasarkan rasio iterasi.
biaya bulanan = finished_seconds x $0.10
+ draft_seconds x $0.034
Contoh: tim mengirimkan 5 menit video 720p per bulan dengan rasio draf-ke-final 10:1 pada 360p.
300 detik selesai x $0.10 = $30.00
3.000 detik draf x $0.034 = $102.00
-------
$132.00
Draf tetap menjadi sumber biaya terbesar meskipun tarifnya hanya sepertiga, karena jumlahnya 10 kali lebih banyak daripada video final.
Jika ingin menurunkan biaya, kurangi jumlah percobaan per hasil yang baik melalui prompt yang lebih terarah atau kontrol keyframe. Mengurangi biaya render akhir biasanya bukan pengungkit terbesar.
FAQ
Apakah Gemini Omni 1.1 Flash gratis?
Tidak melalui API. Omni tidak memiliki tingkat gratis, meskipun model ini gratis di YouTube Shorts dan YouTube Create. Lihat ringkasan akses gratis untuk jalur tersebut.
Model teks Google seperti Gemini 3.6 Flash masih menyediakan jalur gratis dengan batasan laju melalui AI Studio.
Berapa biaya video 10 detik?
Sekitar $1.01 pada 720p atau $0.34 pada 360p.
Mengapa video ditagih dalam token?
Google menggunakan token sebagai satuan harga untuk semua keluaran model. Keluaran video 720p dihitung sebagai 5.792 token per detik dan ditagih $17.50 per juta token keluaran video.
Apakah gambar masukan dan klip referensi dikenakan biaya tambahan?
Ya. Tarifnya $1.50 per juta token masukan, tetapi biayanya kecil dibandingkan keluaran video.
Apakah 4K layak digunakan?
Gunakan 4K hanya untuk hasil akhir. Karena 1080p dan 4K merupakan upscale, resolusi tersebut tidak menambahkan detail yang tidak dihasilkan model. Keduanya hanya menambah ukuran file dan biaya.
Apakah generasi yang gagal tetap ditagih?
Generasi yang mengembalikan video akan ditagih. Penolakan filter konten dan error yang tidak menghasilkan keluaran seharusnya tidak ditagih. Tetap pantau dasbor penagihan selama minggu pertama pipeline baru.
Kesimpulan
Ekonomi Gemini Omni 1.1 Flash lebih menghargai disiplin daripada eksperimen tanpa batas:
- Buat draf pada 360p.
- Cache keluaran secara agresif.
- Gunakan timeout yang realistis.
- Batasi retry otomatis.
- Simpan satu permintaan untuk setiap jenis tugas.
- Pantau perubahan hasil ketika model diperbarui.
Unduh Apidog untuk memeriksa permintaan dan respons sebelum tagihan menunjukkan masalahnya.
Top comments (1)
The token-based billing model you described is a clever approach to controlling costs, especially for iterative processes like video generation. By starting with drafts at 360p, you not only reduce expenses significantly but also expedite the feedback loop, which is essential in creative workflows. It would be interesting to see if further optimizations could be integrated, such as caching frequently used assets to further save on input token costs. If you’re looking for help refining video pipeline strategies or implementing additional features, I’d be happy to discuss a paid collaboration!