DEV Community

Cover image for Cara Menggunakan Gemini 3.8 Flash Gratis
Walse
Walse

Posted on Originally published at apidog.com

Cara Menggunakan Gemini 3.8 Flash Gratis

Cara Menggunakan Gemini 3.8 Flash secara Gratis melalui API

Gemini 3.8 Flash dirilis pada 2 September 2026. Berbeda dari sebagian besar peluncuran model frontier tahun ini, Google menyediakan jalur gratis yang benar-benar dapat digunakan: Anda bisa mengobrol dengannya di Google AI Studio atau memanggilnya melalui Gemini API dengan kunci yang dapat dibuat dalam waktu sekitar satu menit. Google menyebutnya “model Flash paling cerdas kami”, dan tingkat gratis menggunakan ID model yang sama, gemini-3.8-flash, seperti pelanggan berbayar.

Coba Apidog hari ini

Ada tiga batasan utama:

  • Tingkat gratis memiliki batas laju.
  • Data pada tingkat gratis dapat digunakan Google untuk meningkatkan produknya.
  • Aplikasi Gemini tidak menyertakan 3.8 Flash pada paket gratis. Anda memerlukan Google AI Pro atau Ultra.

Untuk spesifikasi lengkap, baca apa itu Gemini 3.8 Flash. Jika ingin menjalankan permintaan pertama dalam lima menit, ikuti langkah berikut.

Gemini 3.8 Flash

Akses gratis sekilas

Permukaan Biaya Gemini 3.8 Flash disertakan? Kendala
Google AI Studio (web playground) $0 Ya Dibatasi laju; data digunakan untuk meningkatkan produk
Gemini API tingkat gratis $0 Ya Batasan yang sama, ditampilkan di halaman batas laju AI Studio
Aplikasi Gemini, paket gratis $0 Tidak 3.8 Flash membutuhkan Google AI Pro atau Ultra
Mode AI di Google Search $0 Ya, untuk konsumen Tidak ada API atau kontrol atas tingkat pemikiran
Gemini di Google Sheets Tergantung paket Ya, untuk konsumen Tidak ada API
Grounding Google Search 5.000 permintaan/bulan gratis Berbagi di Gemini 3.x Setelah itu $14 per 1.000 permintaan
API Batch Diskon 50% dari harga berbayar Ya Tidak gratis; jalur berbayar termurah
Gemini 3.8 Flash Cyber Tidak dijual Tidak Hanya untuk Fairwind Program; tidak ada API publik dengan harga berapa pun

Langkah 1: Buka AI Studio dan pilih gemini-3.8-flash

Buka Google AI Studio dan masuk dengan akun Google. Anda tidak membutuhkan akun penagihan atau kartu kredit.

Pada pemilih model, pilih gemini-3.8-flash. Ini adalah ID stabil tanpa sufiks pratinjau.

Pengaturan model menyediakan tiga tingkat pemikiran:

  • low
  • medium — default
  • high

minimal tidak didukung. Jika dikirim melalui API, model akan mengembalikan kesalahan validasi, bukan melakukan fallback secara diam-diam. Lihat panduan tingkat pemikiran untuk perbandingan biaya token dan waktu pada setiap tingkat.

Dua pengaturan penting untuk penggunaan gratis:

  1. Pertahankan suhu pada nilai default 1.0. Google merekomendasikan nilai ini untuk semua model Gemini 3 karena suhu yang lebih rendah dapat menyebabkan pengulangan atau output yang menurun kualitasnya.
  2. Mulai dengan low. Gemini 3.8 Flash dirancang untuk mengerjakan tugas kompleks dengan langkah penalaran yang lebih kecil dan pemanggilan alat berulang. Google juga menyatakan model ini dapat menggunakan lebih banyak token pada tugas yang lebih panjang dan kompleks. Karena kuota dihitung dalam token per menit, tingkat pemikiran tinggi dapat menghabiskan kuota gratis lebih cepat daripada Gemini 3.7 Flash.

Langkah 2: Dapatkan kunci API gratis

Di AI Studio, buka halaman kunci API dan buat kunci pada proyek baru atau proyek yang sudah ada. Kunci ini langsung berfungsi pada tingkat gratis.

Halaman harga Gemini API mencantumkan input dan output Gemini 3.8 Flash sebagai Gratis pada tingkat tersebut, sekaligus menampilkan harga berbayarnya. Jika belum pernah membuat kunci, ikuti panduan kunci Gemini API gratis.

Simpan kunci sebagai variabel lingkungan agar tidak masuk ke kode atau riwayat shell:

export GEMINI_API_KEY="paste-your-key-here"
Enter fullscreen mode Exit fullscreen mode

Perlakukan kunci API seperti kata sandi. Tingkat gratis tidak memiliki penagihan, jadi kunci yang bocor tidak akan langsung menimbulkan tagihan. Namun, orang lain tetap dapat menghabiskan kuota harian Anda.

Langkah 3: Jalankan panggilan gratis pertama

Gemini 3.x terutama berjalan melalui Interactions API. Anda dapat mengirim permintaan tanpa SDK:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-[REDACTED CREDENTIAL] -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"Jelaskan caching HTTP dalam 3 kalimat.","generation_config":{"thinking_level":"low"}}'
Enter fullscreen mode Exit fullscreen mode

Responsnya berupa daftar langkah eksekusi, seperti proses pemikiran model dan pemanggilan alat jika ada. Respons tersebut diakhiri langkah model_output yang berisi teks jawaban.

Jika kode Anda masih menggunakan generateContent, kode tersebut tetap berfungsi. Google menyebut endpoint ini sebagai warisan, tetapi masih “didukung sepenuhnya” tanpa tanggal penghentian. Pada endpoint lama, tingkat pemikiran berada di:

generationConfig.thinkingConfig.thinkingLevel
Enter fullscreen mode Exit fullscreen mode

Contoh Interactions API, endpoint lama, ekuivalen Python, dan percakapan multi-turn dengan previous_interaction_id tersedia dalam panduan API Gemini 3.8 Flash.

Jika menerima respons 429, berarti Anda telah mencapai batas laju tingkat gratis. Tunggu hingga kuota tersedia kembali atau naik ke Tingkat 1.

Apa yang Anda “bayar” pada tingkat gratis

Tidak ada biaya dolar, tetapi ada tiga trade-off.

1. Batas laju

Tingkat gratis membatasi:

  • Permintaan per menit
  • Token per menit
  • Permintaan per hari per model

Google memublikasikan angka terbaru di halaman batas laju AI Studio, bukan di teks dokumentasi. Angka tersebut dapat berubah tanpa entri changelog, jadi jangan mengandalkan angka dari artikel atau blog lama. Dokumen batas laju resmi menjelaskan cara kerja tingkatan tersebut.

2. Penggunaan data

Google menyatakan bahwa prompt dan output pada tingkat gratis digunakan untuk meningkatkan produknya. Hal ini mungkin dapat diterima untuk benchmark atau aplikasi percobaan, tetapi tidak untuk:

  • Data pelanggan
  • Kode sumber yang belum dirilis
  • Informasi di bawah NDA
  • Data sensitif lainnya

Jika membutuhkan privasi berbeda, aktifkan penagihan sebelum mengirim data sensitif.

3. Konsumsi token

Menurut pengukuran Artificial Analysis, Gemini 3.8 Flash pada tingkat high menggunakan sekitar 48.000 token output per tugas pada indeks mereka—30% lebih banyak daripada Gemini 3.7 Flash.

Token pemikiran dihitung terhadap batas token per menit yang sama dengan output yang terlihat. Untuk memperpanjang kuota gratis, gunakan low atau medium sampai Anda membutuhkan kapasitas berbayar.

Aplikasi Gemini bukan jalur gratis

Banyak hasil pencarian “Gemini 3.8 Flash gratis” keliru karena mencampur akses API dan akses aplikasi konsumen.

Di aplikasi Gemini, 3.8 Flash tersedia untuk pelanggan Google AI Pro dan Ultra. Paket aplikasi gratis tidak menyertakannya. Jika Anda membuka aplikasi tanpa langganan dan melihat model Flash, model tersebut bukan Gemini 3.8 Flash.

Tanpa biaya tambahan, Anda dapat menemukan model ini di:

  • Mode AI di Google Search
  • Gemini di Google Sheets

Namun, kedua permukaan tersebut tidak menyediakan kontrol atas tingkat pemikiran, jumlah token, atau API. Untuk pengembangan aplikasi, gunakan AI Studio atau Gemini API tingkat gratis.

Grounding gratis: 5.000 permintaan Google Search per bulan

Grounding Google Search memungkinkan model mengambil hasil web terbaru untuk digunakan dalam jawaban. Kuotanya adalah 5.000 permintaan gratis per bulan, dibagikan ke seluruh model Gemini 3.x.

Setelah kuota habis, biayanya adalah $14 per 1.000 permintaan. Kuota tersebut merupakan satu kumpulan bulanan, bukan kuota terpisah per model. Eksperimen grounding pada Gemini 3 Pro dan Gemini 3.8 Flash akan menggunakan 5.000 permintaan yang sama.

Untuk prototipe yang membutuhkan data terbaru, kuota ini cukup besar. Fitur produksi tetap membutuhkan anggaran.

Saat kuota gratis habis: jalur berbayar termurah

Anda akan mengetahui waktunya ketika menerima 429 di tengah demo atau mencapai batas harian pada sore hari. Berikut urutan opsi dari yang paling murah.

1. Hubungkan akun penagihan — Tingkat 1

Menghubungkan penagihan ke proyek melalui AI Studio memindahkan proyek ke Tingkat 1. Tidak perlu membelanjakan uang untuk membukanya.

  • Batas pengeluaran: $250
  • Tingkat 2: setelah pengeluaran $100 dan tiga hari, dengan batas $2.000
  • Tingkat 3: setelah pengeluaran $1.000 dan 30 hari

2. Gunakan harga perkenalan

Hingga 31 Desember 2026, Gemini 3.8 Flash dikenai biaya:

  • Input: $0,75 per juta token
  • Output: $3,75 per juta token

Token pemikiran ditagih sebagai output.

Mulai 1 Januari 2027, tarifnya menjadi:

  • Input: $1,50 per juta token
  • Output: $7,50 per juta token

Seribu permintaan dengan masing-masing 2.000 token input dan 500 token output berbiaya sekitar $3,38 pada harga perkenalan. Lihat rincian harga Gemini 3.8 Flash untuk perhitungan per tugas.

3. Gunakan Batch API untuk pekerjaan asinkron

Batch API memangkas tarif menjadi:

  • Input: $0,375 per juta token
  • Output: $1,875 per juta token

Harga ini berlaku hingga akhir 2026. Seribu permintaan dengan ukuran contoh sebelumnya berbiaya sekitar $1,69.

Akun Tingkat 1 dapat memiliki hingga 3 juta token dalam antrean secara bersamaan. Batch cocok untuk evaluasi, pengisian ulang data, dan pekerjaan malam hari. Lihat panduan Gemini Batch API.

4. Cache prefiks yang stabil

Pada harga perkenalan, context caching berbiaya $0,075 per juta token yang di-cache—sepersepuluh dari harga input segar.

Jika prompt sistem atau dokumen panjang dikirim ulang pada setiap giliran, caching adalah optimasi pertama yang perlu diperiksa.

Fitur yang tidak tersedia gratis

Berikut batasan yang perlu diketahui:

  • Aplikasi Gemini: hanya tersedia untuk pelanggan Pro atau Ultra.
  • Privasi: data tingkat gratis digunakan untuk meningkatkan produk Google.
  • Headroom: batas laju tersedia di halaman AI Studio dan tidak terlalu besar. Tingkat gratis cocok untuk evaluasi dan alat kecil, bukan peluncuran skala besar.
  • Gemini 3.8 Flash Cyber: hanya tersedia melalui Fairwind Program untuk pemerintah, operator infrastruktur, dan pemelihara perangkat lunak. Tidak ada API publik, harga publik, atau opsi hosting sendiri.
  • Live API, pembuatan gambar, dan pembuatan audio: tidak didukung Gemini 3.8 Flash pada tingkat mana pun. Input yang didukung mencakup teks, gambar, video, audio, dan PDF; outputnya berupa teks.
  • Akses “tak terbatas”: situs yang menjanjikan akses Gemini tanpa batas kemungkinan mem-proxy kunci pihak lain atau menyediakan model berbeda. Gunakan panduan akses API Gemini gratis untuk memeriksanya.
  • Gemini 3.6 Flash: playbook tingkat gratis pada panduan Gemini 3.6 Flash masih relevan untuk strategi penghematan kuota.

Maksimalkan kuota dengan Apidog

Tingkat gratis paling efektif jika digunakan secara disiplin. Hindari mengetik ulang permintaan secara manual, memicu 429 tanpa sengaja, atau menggunakan tingkat pemikiran high untuk tugas sederhana.

Dengan Apidog, Anda dapat:

  1. Menyimpan GEMINI_API_KEY sebagai variabel lingkungan agar kunci tidak muncul di badan permintaan atau koleksi bersama.
  2. Menyimpan permintaan Interactions API dan generateContent sebagai permintaan bernama.
  3. Mengganti model dan thinking_level dengan variabel tanpa mengedit JSON secara manual.
  4. Menambahkan pengujian kode status agar 429 muncul sebagai tes gagal, bukan respons kosong yang membingungkan.
  5. Memantau usageMetadata.thoughtsTokenCount pada endpoint lama untuk mengetahui konsumsi token pemikiran.
  6. Menjadwalkan satu uji asap tingkat low setiap hari.

Uji asap harian membantu mendeteksi perubahan perilaku model atau batas gratis sebelum pengguna Anda menyadarinya. Unduh Apidog, lalu ikuti panduan menjadwalkan tes API di Apidog.

FAQ

Apakah Gemini 3.8 Flash gratis?

Ya. Gemini 3.8 Flash tersedia melalui Google AI Studio dan Gemini API tingkat gratis, dengan batas laju serta penggunaan data untuk meningkatkan produk Google. ID modelnya sama dengan yang digunakan tingkat berbayar: gemini-3.8-flash.

Bisakah saya menggunakan Gemini 3.8 Flash di aplikasi Gemini secara gratis?

Tidak. Aplikasi Gemini menyediakan 3.8 Flash untuk pelanggan Google AI Pro dan Ultra. Mode AI di Google Search dan Gemini di Sheets adalah permukaan konsumen yang dapat digunakan tanpa langganan.

Berapa batas laju Gemini 3.8 Flash pada tingkat gratis?

Google menampilkannya per model di halaman batas laju AI Studio. Batas tersebut dapat berubah. Saat membutuhkan kapasitas lebih besar, hubungkan akun penagihan untuk masuk ke Tingkat 1 tanpa harus memenuhi jumlah pengeluaran tertentu terlebih dahulu.

Apakah tingkat gratis mencakup fitur pemikiran?

Ya. Tingkat low, medium, dan high tersedia pada tingkat gratis, dengan medium sebagai default. minimal mengembalikan kesalahan pada Gemini 3.8 Flash. Karena token pemikiran ikut dihitung dalam kuota, low adalah pilihan paling hemat.

Apakah Gemini 3.8 Flash Cyber gratis?

Gemini 3.8 Flash Cyber tidak tersedia di luar Fairwind Program. Pengembang umum hanya dapat menggunakan Gemini 3.8 Flash dan menjalankan pengujian keamanan API sendiri terhadap model tersebut.

Mulai gratis, lalu evaluasi

Tingkat gratis Gemini 3.8 Flash adalah lingkungan evaluasi yang nyata, bukan sekadar demo. Buat kunci API, gunakan low untuk eksperimen, jauhkan data sensitif, dan periksa halaman batas laju secara berkala.

Ketika 429 mulai menghambat pekerjaan, hubungkan penagihan untuk Tingkat 1. Gunakan Batch API untuk tugas asinkron; dengan tarif input $0,375 per juta token hingga akhir 2026, bulan berbayar pertama mungkin lebih murah daripada waktu yang terbuang menunggu kuota gratis direset.

Referensi

Top comments (0)