DEV Community

Cover image for Gemini 3.6 Flash vs 3.5 Flash: Perbedaan, Fitur Baru, dan Perlukah Upgrade?
Walse
Walse

Posted on • Originally published at apidog.com

Gemini 3.6 Flash vs 3.5 Flash: Perbedaan, Fitur Baru, dan Perlukah Upgrade?

Google menyegarkan tingkatan Flash pada 21 Juli 2026 dengan merilis Gemini 3.6 Flash. Jika Anda menjalankan 3.5 Flash di produksi, ini adalah pengganti langsung yang lebih murah dan lebih efisien dalam penggunaan token: konteks 1 juta token dan harga input tetap sama, tetapi harga output turun dan model menggunakan lebih sedikit token output untuk menyelesaikan tugas yang sama. Untuk detail model, lihat apa itu Gemini 3.6 Flash.

Coba Apidog hari ini

Jawaban singkat

Lakukan peningkatan ke gemini-3.6-flash jika Anda dapat menjalankan evaluasi dan regresi terlebih dahulu.

Perubahannya:

  • Harga input tetap $1.50 per 1 juta token.
  • Harga output turun dari $9.00 menjadi $7.50 per 1 juta token.
  • Gemini 3.6 Flash menghasilkan sekitar 17% lebih sedikit token output untuk tugas yang sama.
  • Skor penggunaan komputer naik dari 78.4 menjadi 83.0 pada OSWorld-Verified.
  • Alur kerja multi-langkkah membutuhkan lebih sedikit langkah penalaran dan panggilan alat.

Tunda hanya jika gemini-3.5-flash sudah divalidasi untuk produksi dan Anda belum memiliki jendela untuk menjalankan ulang evaluasi.

Gemini 3.6 Flash vs 3.5 Flash

Angka berikut berasal dari postingan blog Google dan halaman model DeepMind Flash.

Atribut Gemini 3.6 Flash Gemini 3.5 Flash
ID model gemini-3.6-flash gemini-3.5-flash
Harga input per 1 juta token $1.50 $1.50
Harga output per 1 juta token $7.50 $9.00
Efisiensi token output ~17% lebih sedikit token output Dasar
Penggunaan komputer, OSWorld-Verified 83.0 78.4
Jendela konteks 1 juta token input 1 juta token input

Harga input dan jendela konteks tidak berubah. Keuntungan utama ada pada biaya output, jumlah token output, dan efisiensi penyelesaian tugas.

Apa yang meningkat

Perbandingan Gemini 3.6 Flash dan Gemini 3.5 Flash

1. Token output lebih sedikit

Gemini 3.6 Flash menggunakan sekitar 17% lebih sedikit token output untuk pekerjaan yang sama. Token output mencakup token berpikir, sehingga efisiensi ini langsung memengaruhi biaya pada beban kerja yang banyak menghasilkan teks, kode, atau jejak agen.

2. Harga output lebih rendah

Tarif output turun dari $9.00 menjadi $7.50 per 1 juta token. Penghematan tarif ini bertumpuk dengan pengurangan jumlah token output.

3. Penggunaan komputer yang lebih baik

Pada OSWorld-Verified, Gemini 3.6 Flash mencetak 83.0, dibandingkan 78.4 untuk 3.5 Flash. Ini relevan jika Anda membuat agen yang:

  • Mengklik elemen UI
  • Mengisi formulir
  • Mengoperasikan alat
  • Menjalankan alur browser atau desktop multi-langkah

4. Lebih sedikit langkah penalaran dan panggilan alat

Untuk alur kerja agen, lebih sedikit panggilan alat berarti lebih sedikit perjalanan pulang-pergi, latensi lebih rendah, dan total token yang lebih kecil. Akurasi pengkodean juga meningkat, yang penting saat model menghasilkan atau mengedit file.

Bentuk API tidak berubah: format permintaan, autentikasi, endpoint, serta modalitas teks, gambar, video, audio, dan PDF tetap sama.

Dampak pada tagihan

Dua penghematan berlaku sekaligus:

  1. Harga per token output lebih rendah.
  2. Jumlah token output lebih sedikit.

Contoh ilustratif: aplikasi Anda menghasilkan 10 juta token output per hari pada Gemini 3.5 Flash.

  • Gemini 3.5 Flash:

    10 juta × $9.00 = $90.00/hari

  • Gemini 3.6 Flash:

    8.3 juta × $7.50 = $62.25/hari

Pada contoh ini, biaya output turun sekitar 31% tanpa mengubah prompt.

Penghematan aktual bergantung pada rasio input dan output:

  • Beban kerja banyak membaca, sedikit menulis seperti klasifikasi atau ekstraksi akan melihat perubahan total yang lebih kecil.
  • Beban kerja banyak menghasilkan output seperti pembuatan kode, penyusunan konten, atau agen multi-langkah akan mendapat manfaat lebih besar.

Untuk detail tarif, caching, dan token berpikir, lihat harga Gemini 3.6 Flash serta dokumen harga Gemini API.

Kapan tetap menggunakan 3.5 Flash

Tetap gunakan gemini-3.5-flash sementara jika Anda belum dapat memvalidasi ulang perilaku aplikasi.

Contoh alasan yang valid:

  • Rangkaian evaluasi terkait persetujuan kepatuhan.
  • Output model diproses oleh parser atau regex yang sensitif terhadap perubahan format.
  • Validasi skema JSON hilir belum siap.
  • Sprint saat ini tidak menyediakan jendela regresi.

Gemini 3.5 Flash tetap tersedia melalui API. Namun, untuk sebagian besar tim yang dapat menjalankan evaluasi, biaya dan kualitas sama-sama mendukung migrasi ke 3.6 Flash.

Cara bermigrasi

Perubahan kode utamanya hanya mengganti ID model:

- gemini-3.5-flash
+ gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode

Contoh konseptual:

{
  "model": "gemini-3.6-flash",
  "contents": [
    {
      "parts": [
        {
          "text": "Ringkas perubahan pada pull request ini."
        }
      ]
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Badan permintaan, autentikasi, dan endpoint tetap sama. Lihat panduan cara menggunakan Gemini 3.6 Flash API dan dokumentasi Gemini API.

Checklist sebelum produksi

Jangan langsung mengganti model di semua traffic. Jalankan proses berikut:

  1. Jalankan ulang evaluasi pada gemini-3.6-flash dan bandingkan dengan baseline gemini-3.5-flash.
  2. Jalankan pengujian regresi karena frasa atau struktur respons dapat berubah.
  3. Uji parser hilir untuk JSON, regex, validasi skema, dan field yang dibaca aplikasi.
  4. Bandingkan latensi dan penggunaan token pada sampel traffic nyata.
  5. Gunakan feature flag atau canary rollout sebelum promosi penuh.

Perlakukan pertukaran model seperti peningkatan dependensi: uji, bandingkan, lalu rilis bertahap.

Uji regresi migrasi di Apidog

Apidog dapat digunakan untuk membandingkan respons kedua model sebelum perubahan masuk ke produksi. Apidog tidak menjalankan model; Apidog mengirim permintaan API dan memverifikasi responsnya.

Alur kerja A/B yang praktis:

  1. Simpan request Gemini yang sudah ada

    Buat request POST ke Gemini API. Simpan API key sebagai environment variable, bukan di body request.

  2. Duplikat request

    Pertahankan semua parameter tetap sama, lalu ubah satu field saja:

   - gemini-3.5-flash
   + gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode
  1. Tambahkan assertion Verifikasi status code dan field respons yang benar-benar digunakan aplikasi Anda.

Contoh assertion yang perlu diperiksa:

  • Status respons sukses
  • Struktur JSON tetap valid
  • Field wajib tersedia
  • Nilai sesuai batas yang dapat diterima
  • Respons tidak memicu error pada parser hilir
  1. Bandingkan output, latensi, dan token

    Jalankan kedua request dengan input yang sama. Bandingkan respons secara berdampingan dan pastikan respons 3.6 Flash lolos assertion yang sebelumnya lolos pada 3.5 Flash.

  2. Jadwalkan regresi

    Simpan kedua skenario dan jadwalkan sebagai pengujian regresi agar perubahan model atau prompt di masa depan tidak diam-diam merusak kontrak API.

Unduh Apidog untuk menjalankan perbandingan pada request Gemini Anda sendiri.

FAQ

Apakah Gemini 3.6 Flash merupakan pengganti langsung untuk 3.5 Flash?

Secara mekanis, ya. Ganti gemini-3.5-flash dengan gemini-3.6-flash dan pertahankan bagian request lainnya. Namun, tetap jalankan evaluasi dan regresi karena struktur atau frasa output dapat berubah.

Apakah harga input berubah?

Tidak. Harga input tetap $1.50 per 1 juta token pada kedua model. Harga output turun dari $9.00 menjadi $7.50 per 1 juta token.

Mengapa modelnya 3.6, sedangkan Lite dan Cyber masih 3.5?

Dalam penyegaran ini, Google hanya menaikkan Flash andalan ke 3.6. Flash-Lite dan Flash Cyber dirilis sebagai 3.5. Gunakan ID model spesifik, bukan hanya nomor keluarga model.

Apakah tagihan pasti turun 31%?

Tidak. Angka 31% adalah ilustrasi untuk beban kerja yang mengutamakan output. Penghematan aktual bergantung pada rasio token input dan output Anda.

Apakah 3.5 Flash masih bisa digunakan?

Ya. Gemini 3.5 Flash tetap tersedia melalui API. Jika Anda belum dapat menjalankan validasi ulang, menguncinya sementara adalah pilihan yang masuk akal. Rencanakan migrasi pada jendela pengujian berikutnya.

Untuk generasi sebelumnya, lihat apa itu Gemini 3.5.

Bagi sebagian besar tim, langkahnya sederhana: ubah ID model ke gemini-3.6-flash, jalankan evaluasi serta regresi singkat, lalu rilis bertahap. Pertahankan 3.5 Flash hanya bila batasan validasi memang mengharuskannya.

Top comments (0)