Cara Menggunakan Gemini 3.8 Flash secara Gratis melalui API
Gemini 3.8 Flash dirilis pada 2 September 2026. Berbeda dari sebagian besar peluncuran model frontier tahun ini, Google menyediakan jalur gratis yang benar-benar dapat digunakan: Anda bisa mengobrol dengannya di Google AI Studio atau memanggilnya melalui Gemini API dengan kunci yang dapat dibuat dalam waktu sekitar satu menit. Google menyebutnya “model Flash paling cerdas kami”, dan tingkat gratis menggunakan ID model yang sama, gemini-3.8-flash, seperti pelanggan berbayar.
Ada tiga batasan utama:
- Tingkat gratis memiliki batas laju.
- Data pada tingkat gratis dapat digunakan Google untuk meningkatkan produknya.
- Aplikasi Gemini tidak menyertakan 3.8 Flash pada paket gratis. Anda memerlukan Google AI Pro atau Ultra.
Untuk spesifikasi lengkap, baca apa itu Gemini 3.8 Flash. Jika ingin menjalankan permintaan pertama dalam lima menit, ikuti langkah berikut.
Akses gratis sekilas
| Permukaan | Biaya | Gemini 3.8 Flash disertakan? | Kendala |
|---|---|---|---|
| Google AI Studio (web playground) | $0 | Ya | Dibatasi laju; data digunakan untuk meningkatkan produk |
| Gemini API tingkat gratis | $0 | Ya | Batasan yang sama, ditampilkan di halaman batas laju AI Studio |
| Aplikasi Gemini, paket gratis | $0 | Tidak | 3.8 Flash membutuhkan Google AI Pro atau Ultra |
| Mode AI di Google Search | $0 | Ya, untuk konsumen | Tidak ada API atau kontrol atas tingkat pemikiran |
| Gemini di Google Sheets | Tergantung paket | Ya, untuk konsumen | Tidak ada API |
| Grounding Google Search | 5.000 permintaan/bulan gratis | Berbagi di Gemini 3.x | Setelah itu $14 per 1.000 permintaan |
| API Batch | Diskon 50% dari harga berbayar | Ya | Tidak gratis; jalur berbayar termurah |
| Gemini 3.8 Flash Cyber | Tidak dijual | Tidak | Hanya untuk Fairwind Program; tidak ada API publik dengan harga berapa pun |
Langkah 1: Buka AI Studio dan pilih gemini-3.8-flash
Buka Google AI Studio dan masuk dengan akun Google. Anda tidak membutuhkan akun penagihan atau kartu kredit.
Pada pemilih model, pilih gemini-3.8-flash. Ini adalah ID stabil tanpa sufiks pratinjau.
Pengaturan model menyediakan tiga tingkat pemikiran:
low-
medium— default high
minimal tidak didukung. Jika dikirim melalui API, model akan mengembalikan kesalahan validasi, bukan melakukan fallback secara diam-diam. Lihat panduan tingkat pemikiran untuk perbandingan biaya token dan waktu pada setiap tingkat.
Dua pengaturan penting untuk penggunaan gratis:
-
Pertahankan suhu pada nilai default
1.0. Google merekomendasikan nilai ini untuk semua model Gemini 3 karena suhu yang lebih rendah dapat menyebabkan pengulangan atau output yang menurun kualitasnya. -
Mulai dengan
low. Gemini 3.8 Flash dirancang untuk mengerjakan tugas kompleks dengan langkah penalaran yang lebih kecil dan pemanggilan alat berulang. Google juga menyatakan model ini dapat menggunakan lebih banyak token pada tugas yang lebih panjang dan kompleks. Karena kuota dihitung dalam token per menit, tingkat pemikiran tinggi dapat menghabiskan kuota gratis lebih cepat daripada Gemini 3.7 Flash.
Langkah 2: Dapatkan kunci API gratis
Di AI Studio, buka halaman kunci API dan buat kunci pada proyek baru atau proyek yang sudah ada. Kunci ini langsung berfungsi pada tingkat gratis.
Halaman harga Gemini API mencantumkan input dan output Gemini 3.8 Flash sebagai Gratis pada tingkat tersebut, sekaligus menampilkan harga berbayarnya. Jika belum pernah membuat kunci, ikuti panduan kunci Gemini API gratis.
Simpan kunci sebagai variabel lingkungan agar tidak masuk ke kode atau riwayat shell:
export GEMINI_API_KEY="paste-your-key-here"
Perlakukan kunci API seperti kata sandi. Tingkat gratis tidak memiliki penagihan, jadi kunci yang bocor tidak akan langsung menimbulkan tagihan. Namun, orang lain tetap dapat menghabiskan kuota harian Anda.
Langkah 3: Jalankan panggilan gratis pertama
Gemini 3.x terutama berjalan melalui Interactions API. Anda dapat mengirim permintaan tanpa SDK:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-[REDACTED CREDENTIAL] -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Jelaskan caching HTTP dalam 3 kalimat.","generation_config":{"thinking_level":"low"}}'
Responsnya berupa daftar langkah eksekusi, seperti proses pemikiran model dan pemanggilan alat jika ada. Respons tersebut diakhiri langkah model_output yang berisi teks jawaban.
Jika kode Anda masih menggunakan generateContent, kode tersebut tetap berfungsi. Google menyebut endpoint ini sebagai warisan, tetapi masih “didukung sepenuhnya” tanpa tanggal penghentian. Pada endpoint lama, tingkat pemikiran berada di:
generationConfig.thinkingConfig.thinkingLevel
Contoh Interactions API, endpoint lama, ekuivalen Python, dan percakapan multi-turn dengan previous_interaction_id tersedia dalam panduan API Gemini 3.8 Flash.
Jika menerima respons 429, berarti Anda telah mencapai batas laju tingkat gratis. Tunggu hingga kuota tersedia kembali atau naik ke Tingkat 1.
Apa yang Anda “bayar” pada tingkat gratis
Tidak ada biaya dolar, tetapi ada tiga trade-off.
1. Batas laju
Tingkat gratis membatasi:
- Permintaan per menit
- Token per menit
- Permintaan per hari per model
Google memublikasikan angka terbaru di halaman batas laju AI Studio, bukan di teks dokumentasi. Angka tersebut dapat berubah tanpa entri changelog, jadi jangan mengandalkan angka dari artikel atau blog lama. Dokumen batas laju resmi menjelaskan cara kerja tingkatan tersebut.
2. Penggunaan data
Google menyatakan bahwa prompt dan output pada tingkat gratis digunakan untuk meningkatkan produknya. Hal ini mungkin dapat diterima untuk benchmark atau aplikasi percobaan, tetapi tidak untuk:
- Data pelanggan
- Kode sumber yang belum dirilis
- Informasi di bawah NDA
- Data sensitif lainnya
Jika membutuhkan privasi berbeda, aktifkan penagihan sebelum mengirim data sensitif.
3. Konsumsi token
Menurut pengukuran Artificial Analysis, Gemini 3.8 Flash pada tingkat high menggunakan sekitar 48.000 token output per tugas pada indeks mereka—30% lebih banyak daripada Gemini 3.7 Flash.
Token pemikiran dihitung terhadap batas token per menit yang sama dengan output yang terlihat. Untuk memperpanjang kuota gratis, gunakan low atau medium sampai Anda membutuhkan kapasitas berbayar.
Aplikasi Gemini bukan jalur gratis
Banyak hasil pencarian “Gemini 3.8 Flash gratis” keliru karena mencampur akses API dan akses aplikasi konsumen.
Di aplikasi Gemini, 3.8 Flash tersedia untuk pelanggan Google AI Pro dan Ultra. Paket aplikasi gratis tidak menyertakannya. Jika Anda membuka aplikasi tanpa langganan dan melihat model Flash, model tersebut bukan Gemini 3.8 Flash.
Tanpa biaya tambahan, Anda dapat menemukan model ini di:
- Mode AI di Google Search
- Gemini di Google Sheets
Namun, kedua permukaan tersebut tidak menyediakan kontrol atas tingkat pemikiran, jumlah token, atau API. Untuk pengembangan aplikasi, gunakan AI Studio atau Gemini API tingkat gratis.
Grounding gratis: 5.000 permintaan Google Search per bulan
Grounding Google Search memungkinkan model mengambil hasil web terbaru untuk digunakan dalam jawaban. Kuotanya adalah 5.000 permintaan gratis per bulan, dibagikan ke seluruh model Gemini 3.x.
Setelah kuota habis, biayanya adalah $14 per 1.000 permintaan. Kuota tersebut merupakan satu kumpulan bulanan, bukan kuota terpisah per model. Eksperimen grounding pada Gemini 3 Pro dan Gemini 3.8 Flash akan menggunakan 5.000 permintaan yang sama.
Untuk prototipe yang membutuhkan data terbaru, kuota ini cukup besar. Fitur produksi tetap membutuhkan anggaran.
Saat kuota gratis habis: jalur berbayar termurah
Anda akan mengetahui waktunya ketika menerima 429 di tengah demo atau mencapai batas harian pada sore hari. Berikut urutan opsi dari yang paling murah.
1. Hubungkan akun penagihan — Tingkat 1
Menghubungkan penagihan ke proyek melalui AI Studio memindahkan proyek ke Tingkat 1. Tidak perlu membelanjakan uang untuk membukanya.
- Batas pengeluaran: $250
- Tingkat 2: setelah pengeluaran $100 dan tiga hari, dengan batas $2.000
- Tingkat 3: setelah pengeluaran $1.000 dan 30 hari
2. Gunakan harga perkenalan
Hingga 31 Desember 2026, Gemini 3.8 Flash dikenai biaya:
- Input: $0,75 per juta token
- Output: $3,75 per juta token
Token pemikiran ditagih sebagai output.
Mulai 1 Januari 2027, tarifnya menjadi:
- Input: $1,50 per juta token
- Output: $7,50 per juta token
Seribu permintaan dengan masing-masing 2.000 token input dan 500 token output berbiaya sekitar $3,38 pada harga perkenalan. Lihat rincian harga Gemini 3.8 Flash untuk perhitungan per tugas.
3. Gunakan Batch API untuk pekerjaan asinkron
Batch API memangkas tarif menjadi:
- Input: $0,375 per juta token
- Output: $1,875 per juta token
Harga ini berlaku hingga akhir 2026. Seribu permintaan dengan ukuran contoh sebelumnya berbiaya sekitar $1,69.
Akun Tingkat 1 dapat memiliki hingga 3 juta token dalam antrean secara bersamaan. Batch cocok untuk evaluasi, pengisian ulang data, dan pekerjaan malam hari. Lihat panduan Gemini Batch API.
4. Cache prefiks yang stabil
Pada harga perkenalan, context caching berbiaya $0,075 per juta token yang di-cache—sepersepuluh dari harga input segar.
Jika prompt sistem atau dokumen panjang dikirim ulang pada setiap giliran, caching adalah optimasi pertama yang perlu diperiksa.
Fitur yang tidak tersedia gratis
Berikut batasan yang perlu diketahui:
- Aplikasi Gemini: hanya tersedia untuk pelanggan Pro atau Ultra.
- Privasi: data tingkat gratis digunakan untuk meningkatkan produk Google.
- Headroom: batas laju tersedia di halaman AI Studio dan tidak terlalu besar. Tingkat gratis cocok untuk evaluasi dan alat kecil, bukan peluncuran skala besar.
- Gemini 3.8 Flash Cyber: hanya tersedia melalui Fairwind Program untuk pemerintah, operator infrastruktur, dan pemelihara perangkat lunak. Tidak ada API publik, harga publik, atau opsi hosting sendiri.
- Live API, pembuatan gambar, dan pembuatan audio: tidak didukung Gemini 3.8 Flash pada tingkat mana pun. Input yang didukung mencakup teks, gambar, video, audio, dan PDF; outputnya berupa teks.
- Akses “tak terbatas”: situs yang menjanjikan akses Gemini tanpa batas kemungkinan mem-proxy kunci pihak lain atau menyediakan model berbeda. Gunakan panduan akses API Gemini gratis untuk memeriksanya.
- Gemini 3.6 Flash: playbook tingkat gratis pada panduan Gemini 3.6 Flash masih relevan untuk strategi penghematan kuota.
Maksimalkan kuota dengan Apidog
Tingkat gratis paling efektif jika digunakan secara disiplin. Hindari mengetik ulang permintaan secara manual, memicu 429 tanpa sengaja, atau menggunakan tingkat pemikiran high untuk tugas sederhana.
Dengan Apidog, Anda dapat:
- Menyimpan
GEMINI_API_KEYsebagai variabel lingkungan agar kunci tidak muncul di badan permintaan atau koleksi bersama. - Menyimpan permintaan Interactions API dan
generateContentsebagai permintaan bernama. - Mengganti
modeldanthinking_leveldengan variabel tanpa mengedit JSON secara manual. - Menambahkan pengujian kode status agar
429muncul sebagai tes gagal, bukan respons kosong yang membingungkan. - Memantau
usageMetadata.thoughtsTokenCountpada endpoint lama untuk mengetahui konsumsi token pemikiran. - Menjadwalkan satu uji asap tingkat
lowsetiap hari.
Uji asap harian membantu mendeteksi perubahan perilaku model atau batas gratis sebelum pengguna Anda menyadarinya. Unduh Apidog, lalu ikuti panduan menjadwalkan tes API di Apidog.
FAQ
Apakah Gemini 3.8 Flash gratis?
Ya. Gemini 3.8 Flash tersedia melalui Google AI Studio dan Gemini API tingkat gratis, dengan batas laju serta penggunaan data untuk meningkatkan produk Google. ID modelnya sama dengan yang digunakan tingkat berbayar: gemini-3.8-flash.
Bisakah saya menggunakan Gemini 3.8 Flash di aplikasi Gemini secara gratis?
Tidak. Aplikasi Gemini menyediakan 3.8 Flash untuk pelanggan Google AI Pro dan Ultra. Mode AI di Google Search dan Gemini di Sheets adalah permukaan konsumen yang dapat digunakan tanpa langganan.
Berapa batas laju Gemini 3.8 Flash pada tingkat gratis?
Google menampilkannya per model di halaman batas laju AI Studio. Batas tersebut dapat berubah. Saat membutuhkan kapasitas lebih besar, hubungkan akun penagihan untuk masuk ke Tingkat 1 tanpa harus memenuhi jumlah pengeluaran tertentu terlebih dahulu.
Apakah tingkat gratis mencakup fitur pemikiran?
Ya. Tingkat low, medium, dan high tersedia pada tingkat gratis, dengan medium sebagai default. minimal mengembalikan kesalahan pada Gemini 3.8 Flash. Karena token pemikiran ikut dihitung dalam kuota, low adalah pilihan paling hemat.
Apakah Gemini 3.8 Flash Cyber gratis?
Gemini 3.8 Flash Cyber tidak tersedia di luar Fairwind Program. Pengembang umum hanya dapat menggunakan Gemini 3.8 Flash dan menjalankan pengujian keamanan API sendiri terhadap model tersebut.
Mulai gratis, lalu evaluasi
Tingkat gratis Gemini 3.8 Flash adalah lingkungan evaluasi yang nyata, bukan sekadar demo. Buat kunci API, gunakan low untuk eksperimen, jauhkan data sensitif, dan periksa halaman batas laju secara berkala.
Ketika 429 mulai menghambat pekerjaan, hubungkan penagihan untuk Tingkat 1. Gunakan Batch API untuk tugas asinkron; dengan tarif input $0,375 per juta token hingga akhir 2026, bulan berbayar pertama mungkin lebih murah daripada waktu yang terbuang menunggu kuota gratis direset.
Referensi
- Postingan peluncuran Gemini 3.8 Flash dan 3.8 Flash Cyber
- Apa itu Gemini 3.8 Flash
- Google AI Studio
- Panduan tingkat pemikiran Gemini 3.8 Flash
- Harga Gemini API
- Panduan kunci Gemini API gratis
- Panduan API Gemini 3.8 Flash
- Halaman batas laju AI Studio
- Dokumentasi batas laju Gemini API
- Rincian harga Gemini 3.8 Flash
- Panduan Gemini Batch API
- Panduan akses API Gemini gratis
- Cara menggunakan Gemini 3.6 Flash secara gratis
- Apidog
- Unduh Apidog
- Cara menjadwalkan tes API di Apidog

Top comments (0)