DEV Community

Cover image for Gemini 3.6 Flash 2026 Fiyatı: Gerçek Maliyeti
Tobias Hoffmann
Tobias Hoffmann

Posted on • Originally published at apidog.com

Gemini 3.6 Flash 2026 Fiyatı: Gerçek Maliyeti

Gemini 3.6 Flash'ın 1 milyon giriş tokenı başına maliyeti 1,50 dolar, 1 milyon çıkış tokenı başına maliyeti ise 7,50 dolardır. Bu, yerini aldığı modelden daha ucuzdur. Google, güncellemeyi 21 Temmuz 2026'da yayınladı ve API faturasını takip edenler için başlık basit: Flash seviyesi aynı anda hem daha hızlı hem de daha ucuz hale geldi.

Apidog'u bugün deneyin

Bu kılavuz; token başına oranları, bağlam önbelleklemenin etkisini, ücretsiz katmanın kapsamını ve kod yazmadan önce aylık harcamanızı tahmin etmeniz için örnek bir maliyet hesabını içerir. Buradaki tüm rakamlar Google'ın Gemini API fiyatlandırma belgelerinden ve lansman duyurusundan alınmıştır. Modelin genel özellikleri için önce Gemini 3.6 Flash nedir yazısını okuyun.

İsimlendirme notu: Flash sürümü 3.6'ya geçerken, daha ucuz Flash-Lite katmanı 3.5'te kalıyor. Maliyet karşılaştırması yaparken model adını ve sürümünü birlikte kontrol edin.

Gemini 3.6 Flash fiyatlandırmasına bir bakış

Öğe Maliyet
Giriş 1 milyon token başına 1,50 $
Çıkış (düşünme tokenları dahil) 1 milyon token başına 7,50 $
Bağlam önbellekleme: önbelleğe alınmış giriş okuma 1 milyon token başına 0,15 $
Bağlam önbellekleme: depolama Saatlik 1 milyon token başına 1,00 $
Ücretsiz katman Evet, Google AI Studio aracılığıyla; oran sınırlamalı

Dikkat edilmesi gereken iki nokta vardır:

  1. Çıkış fiyatı düşünme tokenlarını içerir. Modelin yanıt vermeden önce yaptığı muhakeme, ayrı bir kalem olarak değil, 7,50 $/1M çıkış tokenı oranıyla faturalandırılır.
  2. Bağlam önbellekleme ücretsiz değildir. Önbelleğe alınmış girişler daha düşük bir okuma ücretine sahiptir; ancak önbelleği sıcak tuttuğunuz süre boyunca depolama ücreti ödersiniz.

Önbellekleme, aynı sistem istemini veya referans belgelerini sık sık yeniden kullanan iş yüklerinde tasarruf sağlar. Tek seferlik ya da seyrek kullanılan bağlamlar için depolama maliyeti tasarrufu azaltabilir.

Gemini 3.5 Flash ile karşılaştırması

Çıkış oranı, Gemini 3.5 Flash'ta 1 milyon token başına 9,00 $ iken Gemini 3.6 Flash'ta 7,50 $'a düştü. Bu, çıkış tokenı başına yaklaşık %17 daha düşük fiyat anlamına gelir.

Daha büyük etki ise Google'ın DeepMind Flash model sayfasında belirttiği token verimliliğidir: Gemini 3.6 Flash, aynı görev için yaklaşık %17 daha az çıkış tokenı üretebilir. Model daha az adımda muhakeme yapar ve çok adımlı işlerde daha az araç çağrısı kullanır.

Bu nedenle iki maliyet avantajı birleşir:

  • Daha düşük çıkış tokenı fiyatı
  • Aynı görev için daha az çıkış tokenı

Eski modele göre bütçeleme yapıyorsanız Gemini 3.5 Flash fiyatlandırma dökümünü yan yana inceleyin. Özellik ve kıyaslama farkları için Gemini 3.6 Flash vs 3.5 Flash makalesine bakın.

Kısa sonuç: 3.6 Flash, yerini aldığı modelden daha düşük maliyetle çalışır. Token tasarrufunun biriktiği uzun ve araç odaklı iş yüklerinde fark daha da büyür.

Ücretsiz katman size ne sağlar?

Google AI Studio üzerinden erişilebilen gerçek bir ücretsiz katman vardır. Gemini 3.6 Flash'ı kredi kartı olmadan çağırabilir, prototip geliştirebilir ve hafif testler yapabilirsiniz.

Ancak ücretsiz katman için şu sınırları dikkate alın:

  • Oran sınırlıdır; üretim trafiği için tasarlanmamıştır.
  • Prototipleme ve düşük hacimli testler için uygundur.
  • Google, ürünlerini iyileştirmek amacıyla ücretsiz katman verilerini kullanabilir.
  • Hassas, müşteriyle ilgili veya tescilli veriler için ücretli API anahtarı kullanın.

Kurulum adımları ve ücretsiz kullanım detayları için Gemini 3.6 Flash'ı ücretsiz olarak nasıl kullanacağınızı inceleyin. Ücretsiz katman sınırsız değildir; ürünü yayınlamadan önce ücretli kullanıma geçiş planı oluşturun.

Çalışılmış bir maliyet örneği

Belgeleri alan ve kısa yanıtlar veren bir ajan çalıştırdığınızı varsayalım:

  • Günlük giriş: 2 milyon token
  • Günlük çıkış: 500 bin token

Gemini 3.6 Flash için günlük maliyet:

  • Giriş: 2M × 1,50 $ = 3,00 $
  • Çıkış: 0,5M × 7,50 $ = 3,75 $
  • Günlük toplam: 6,75 $
  • Aylık toplam, 30 gün: 202,50 $

Aynı görev Gemini 3.5 Flash'ta 600 bin çıkış tokenı üretmiş olsaydı, yalnızca çıkış maliyeti şöyle olurdu:

  • Gemini 3.5 Flash çıkış: 0,6M × 9,00 $ = 5,40 $/gün
  • Gemini 3.6 Flash çıkış: 0,5M × 7,50 $ = 3,75 $/gün

Sonuç:

  • Günlük çıkış tasarrufu: 1,65 $
  • Aylık çıkış tasarrufu: yaklaşık 49,50 $
  • Çıkış maliyetindeki yaklaşık düşüş: %31

Fiyat indirimi ve token azaltımı ayrı ayrı yaklaşık %17 olsa da birleşik etki daha büyüktür: daha ucuz tokenlar için daha az token ödersiniz.

Flash-Lite daha da ucuz

Göreviniz basitse Flash katmanının altında daha düşük maliyetli bir seçenek bulunur: Gemini 3.5 Flash-Lite.

Öğe Gemini 3.5 Flash-Lite maliyeti
Giriş 1 milyon token başına 0,30 $
Çıkış 1 milyon token başına 2,50 $
Önbelleğe alınmış giriş okuma 1 milyon token başına 0,03 $
Önbellek depolama Saatlik 1 milyon token başına 1,00 $

Flash-Lite saniyede yaklaşık 350 çıkış tokenı ile hızlı çalışır. Aynı 2M giriş ve 0,5M çıkış iş yükünde:

  • Giriş: 2M × 0,30 $ = 0,60 $
  • Çıkış: 0,5M × 2,50 $ = 1,25 $
  • Günlük toplam: yaklaşık 1,85 $
  • Aylık toplam: yaklaşık 55,50 $

Bu, aynı token sayılarıyla Gemini 3.6 Flash'tan yaklaşık %70 daha ucuzdur.

Flash-Lite'ı şu işlerde değerlendirin:

  • Sınıflandırma
  • Veri çıkarma
  • Yönlendirme
  • Kısa, yapılandırılmış yanıtlar
  • Yüksek hacimli ve düşük karmaşıklıklı işler

Daha zor çok adımlı muhakemeler için Gemini 3.6 Flash'ı ayırın. Model seçimini netleştirmek için Gemini 3.5 Flash-Lite nedir yazısını, ardından Gemini 3.5 Flash-Lite ve 3.6 Flash karşılaştırmasını inceleyin.

Maliyetlerinizi nasıl kontrol eder ve ölçersiniz?

Faturayı kontrol etmek için dört kaldıraç kullanın.

1. Tekrarlayan bağlamı önbelleğe alın

Her istek uzun bir sistem istemini veya aynı referans belgelerini kullanıyorsa, bağlam önbellekleme maliyeti düşürebilir.

  • Normal giriş: 1,50 $ / 1M token
  • Önbelleğe alınmış giriş okuma: 0,15 $ / 1M token
  • Önbellek depolama: 1,00 $ / 1M token / saat

Önbelleğe alma, aynı öneki saat içinde sık sık yeniden kullandığınızda anlamlıdır. Tek seferlik isteklerde depolama maliyeti nedeniyle avantaj sağlamayabilir.

2. İstemleri kısaltın ve çıkışı sınırlandırın

Çıkış tokenları giriş tokenlarından beş kat pahalıdır; ancak gereksiz uzun girişler de ölçek büyüdükçe maliyet yaratır.

Uygulayabileceğiniz adımlar:

  • Tekrarlayan talimatları kaldırın.
  • Gereksiz bağlam belgelerini isteme eklemeyin.
  • Yanıt biçimini netleştirin.
  • Maksimum çıkış tokenı sınırı belirleyin.
  • Uzun serbest metin yerine gerektiğinde yapılandırılmış çıktı isteyin.

3. Basit görevleri Flash-Lite'a yönlendirin

Her isteği aynı modele göndermeyin. Basit ve yüksek hacimli işlemleri Flash-Lite'a, çok adımlı muhakeme gerektiren istekleri 3.6 Flash'a yönlendirin.

Örnek yönlendirme mantığı:

Sınıflandırma / çıkarma / kısa JSON yanıtı  -> Flash-Lite
Araç kullanımı / çok adımlı analiz / zor muhakeme -> Gemini 3.6 Flash
Enter fullscreen mode Exit fullscreen mode

4. Gerçek token kullanımını ölçün

Tahminler yerine API yanıtındaki usageMetadata alanını izleyin. Bu alan, çağrının giriş, çıkış ve düşünme tokenı kullanımını gösterir.

Yanıtta kontrol etmeniz gereken yapı:

{
  "usageMetadata": {
    "promptTokenCount": 0,
    "candidatesTokenCount": 0,
    "totalTokenCount": 0
  }
}
Enter fullscreen mode Exit fullscreen mode

Her isteğin maliyetini aşağıdaki formülle hesaplayabilirsiniz:

giriş maliyeti = promptTokenCount / 1_000_000 × 1,50 $
çıkış maliyeti = candidatesTokenCount / 1_000_000 × 7,50 $
toplam maliyet = giriş maliyeti + çıkış maliyeti
Enter fullscreen mode Exit fullscreen mode

Bu izleme yaklaşımı, istemde yapılan küçük bir değişikliğin çıkış tokenlarını iki katına çıkarıp çıkarmadığını erken görmenizi sağlar.

Apidog ile Gemini API için POST isteği oluşturabilir, API anahtarını ortam değişkeninde saklayabilir ve gerçek istemlerinizi çalıştırabilirsiniz. Her çağrının token kullanımını görmek için yanıttaki usageMetadata alanlarını inceleyin. Token bütçeniz aşıldığında testi başarısız kılacak kontroller de ekleyebilirsiniz.

Örneğin, beklenmeyen maliyet artışını yakalamak için şu tür bir test koşulu kullanın:

const usage = response.body.usageMetadata;

if (usage.totalTokenCount > 10000) {
  throw new Error("Token bütçesi aşıldı");
}
Enter fullscreen mode Exit fullscreen mode

Bu API testlerini belirli aralıklarla çalışacak şekilde planlayabilir ve maliyet regresyonlarını üretime çıkmadan önce tespit edebilirsiniz. Başlamak için Apidog'u indirin ve Gemini uç noktanıza bir istek gönderin.

SSS

Gemini 3.6 Flash, 1 milyon token başına ne kadar maliyetlidir?

Giriş için 1,50 $ ve çıkış için 7,50 $ maliyeti vardır. Bağlam önbelleğe alma okumaları 1 milyon token başına 0,15 $, depolama ise saatlik 1 milyon token başına 1,00 $'dır.

Çıkış fiyatı düşünme tokenlarını içeriyor mu?

Evet. Modelin yanıt vermeden önce yaptığı muhakeme, 7,50 $'lık çıkış oranı üzerinden faturalandırılır. Düşünme tokenları için ayrı bir ücret yoktur; ancak toplam çıkış kullanımına dahil edilir.

Gerçekten ücretsiz bir katman var mı?

Evet. Google AI Studio üzerinden kullanılabilir ve oran sınırlıdır. Prototipleme ile test için uygundur, üretim kullanımı için tasarlanmamıştır. Google ücretsiz katman verilerini ürünlerini iyileştirmek için kullanabileceğinden, hassas verileri ücretli anahtarla kullanın.

Gemini 3.6 Flash, 3.5 Flash'tan daha mı ucuz?

Evet. Çıkış oranı 9,00 $'dan 7,50 $'a düştü. Ayrıca 3.6 Flash, aynı görev için yaklaşık %17 daha az çıkış tokenı kullanabilir. Bu iki etki birleştiğinde, çıkış maliyeti yaklaşık %31 azalabilir.

Flash-Lite'ı ne zaman kullanmalıyım?

Görev basit ve hacim yüksek olduğunda kullanın. Flash-Lite; sınıflandırma, çıkarma, yönlendirme ve kısa yapılandırılmış çıktılar için uygundur. Daha zor muhakeme gerektiren işler için Gemini 3.6 Flash daha uygundur.

Gemini 3.6 Flash, fiyatın düşerken model verimliliğinin de arttığı bir güncellemedir. Giriş için 1,50 $, çıkış için 7,50 $ bütçeleyin; düşünme tokenlarının çıkış fiyatına dahil olduğunu unutmayın. Maliyeti daha da azaltmak için tekrarlayan bağlamı önbelleğe alın, basit işleri Flash-Lite'a yönlendirin ve her çağrının usageMetadata değerlerini ölçün.

Gemini API maliyetlerinin sürümler arasında nasıl değiştiğine dair tarihsel bağlam için Gemini 3.0 API maliyet dökümünü inceleyin. Ardından Apidog ile kendi çağrılarınızı ölçerek planladığınız token sayılarının gerçek faturanızla eşleştiğini doğrulayın.

Top comments (0)