DEV Community

Cover image for Gemini 3.8 Flash Nedir
Tobias Hoffmann
Tobias Hoffmann

Posted on Originally published at apidog.com

Gemini 3.8 Flash Nedir

Gemini 3.8 Flash: Daha Uzun Düşünen Flash Modeli ve Gerçek Maliyeti

Gemini 3.8 Flash, Google’ın en yeni Flash seviyesi modelidir. 2 Eylül 2026’da, güvenlik odaklı ikizi Gemini 3.8 Flash Cyber ile birlikte yayınlandı. Bu, altı hafta içindeki üçüncü Flash sürümüdür: 21 Temmuz’daki Gemini 3.6 Flash ve 13 Ağustos’taki Gemini 3.7 Flash’ın ardından geldi. Model, 31 Aralık 2026’ya kadar milyon giriş jetonu başına 0,75 ABD doları ve milyon çıkış jetonu başına 3,75 ABD doları olan 3.7 Flash tanıtım fiyatını koruyor. Google onu “uzun vadeli yazılım mühendisliği, otonom ajanlar ve karmaşık kurumsal iş akışları için tasarlanmış en zeki Flash modelimiz” olarak tanımlıyor.

Apidog'u bugün deneyin

Gemini 3.8 Flash

Kısa özet

Gemini 3.8 Flash’ın ana yeniliği fiyat veya bağlam penceresi değil, davranışıdır. Model:

  • Daha küçük muhakeme adımları atar.
  • Çıktısını süreç boyunca doğrular.
  • Araçları yinelemeli olarak çağırır.
  • Zorlu görevlerde daha fazla çıkış jetonu kullanabilir.

Artificial Analysis, 3.7 Flash’a kıyasla yaklaşık %30 daha fazla çıkış jetonu ölçtü. Jeton başına fiyat değişmedi; ancak görev başına maliyet arttı.

Özellik Değer
API model kimliği gemini-3.8-flash
Yayın tarihi 2 Eylül 2026
Temel aldığı model Gemini 3.7 Flash
Bağlam penceresi 1.048.576 giriş jetonu
Maksimum çıkış 65.536 jeton
Giriş modaliteleri Metin, görsel, video, ses, PDF
Çıkış modaliteleri Yalnızca metin
Düşünme seviyeleri low, medium (varsayılan), high
Tanıtım fiyatı 0,75 ABD doları / 1 milyon giriş jetonu; 3,75 ABD doları / 1 milyon çıkış jetonu
Standart fiyat 1 Ocak 2027’den itibaren 1,50 / 7,50 ABD doları
Önbelleğe alınmış giriş 0,075 ABD doları / 1 milyon jeton
Toplu API %50 indirim
Bilgi kesim tarihi Mart 2026
Geliştirici erişimi Gemini API, Google AI Studio, Android Studio, Google Antigravity, Stitch, Gemini Enterprise
Tüketici erişimi Gemini uygulaması, Arama’da AI Modu, Google E-Tablolar’da Gemini
Gemini 3.7 Flash durumu Tamamen destekleniyor; kullanım sonlandırma tarihi yok

İki ayrıntıya dikkat edin:

  1. Varsayılan düşünme seviyesi medium’dur; Gemini 3 Pro’daki gibi high değildir.
  2. minimal seviyesi sessizce low seviyesine eşlenmez, doğrulama hatası döndürür. Ayrıntılar için düşünme seviyeleri kılavuzuna bakabilirsiniz.

Model kartındaki Mart 2026 bilgi kesim tarihi için ayrıca bir uyarı bulunur: bazı alanlarda bilgi Ocak 2025 ile sınırlı olabilir.

Gemini 3.8 Flash nedir?

Flash, Google’ın çoğu üretim trafiği için tasarladığı iş yükü kademesidir. Pro en zor problemleri hedeflerken Flash; yazılım mühendisliği, ajan döngüleri ve yüksek hacimli kurumsal iş akışlarına odaklanır.

Google, 3.8 Flash’ı “şimdiye kadarki en zeki iş yükü modelimiz” olarak adlandırıyor. DeepMind model kartı ise modeli yeni bir temel modelden çok Gemini 3.7 Flash tabanlı bir iyileştirme olarak tanımlıyor.

Yayın takvimi oldukça sıkışık:

  • Gemini 3.6 Flash: 21 Temmuz 2026, 1,50 / 7,50 ABD doları
  • Gemini 3.7 Flash: 13 Ağustos 2026, 0,75 / 3,75 ABD doları tanıtım fiyatı
  • Gemini 3.8 Flash: 2 Eylül 2026, 0,75 / 3,75 ABD doları tanıtım fiyatı

Google bunu altı hafta içindeki üçüncü Flash sürümü olarak tanımlıyor. Artificial Analysis, 3.5 Flash-Lite’ı da sayarak dört aydan kısa sürede dördüncü Flash modelinden söz ediyor.

Bu sürümle birlikte Gemini 3.8 Pro, Gemini 4 veya yeni bir Flash-Lite modeli yayınlanmadı. Google, Pro güncellemesinin tarihini de açıklamadı. 3.7 Flash hâlâ tamamen destekleniyor; 3.7 Flash’taki yenilikler yazısı artık önceki nesli açıklıyor.

“Daha sıkı çalışma” tasarımı maliyeti nasıl etkiliyor?

Google’ın açıklamasına göre Gemini 3.8 Flash, karmaşık görevlerde:

  • Ek muhakeme adımları yürütür.
  • Araçları yinelemeli olarak çağırır.
  • Daha küçük adımlarla ilerler.
  • Çalışmasını yol boyunca doğrular.

Bu yaklaşım doğruluk ve ajan performansını artırabilir; ancak görev başına daha fazla jeton tüketir.

Artificial Analysis’in bağımsız ölçümlerine göre yüksek düşünme seviyesinde:

  • Gemini 3.8 Flash görev başına ortalama 48.000 çıkış jetonu kullandı.
  • Bu değer, 3.7 Flash’tan yaklaşık %30 daha fazla.
  • Görev başına maliyet 0,40 ABD dolarından 0,58 ABD dolarına yükseldi.
  • Ortalama süre 2,2 dakikadan 2,5 dakikaya çıktı.

Düşünme seviyesini düşürmek maliyeti azaltır:

Düşünme seviyesi Görev başına yaklaşık maliyet Süre
high 0,58 ABD doları 2,5 dakika
medium 0,41 ABD doları
low 0,24 ABD doları 0,8 dakika

Bu nedenle thinking_level artık yalnızca teknik bir ayar değildir; doğrudan yönlendirme ve bütçeleme kararıdır:

  • Gecikmeye duyarlı uç noktalar: low
  • Genel ajan iş akışları: medium
  • Uzun süren, zor görevler: high

Hız büyük ölçüde değişmedi. Google’dan Logan Kilpatrick modeli 3.7 Flash ile “aynı fiyatta, yaklaşık aynı hızda” olarak tanımladı. Artificial Analysis, yüksek düşünme seviyesinde saniyede 302,1 çıkış jetonu ölçtü. İlk jetona ulaşma süresinin 13,30 saniye olması, yavaş bir ağ yolundan çok modelin yanıt öncesi muhakemesinden kaynaklanıyor.

Kıyaslamalar ne söylüyor?

Google, DeepMind Flash sayfasında üç kıyaslama tablosu yayınladı:

Kıyaslama 3.8 Flash 3.7 Flash Claude Opus 5 GPT-5.6 Sol GPT-5.6 Terra Claude Sonnet 5
Vals Finans Ajanı v2 %61,4 %59,0 %58,6 %53,8 %54,4 %53,9
Harvey Hukuk Ajanı Kıyaslaması %10,0 %8,8 %6,7 %2,5 %0,8 %5,0
HLE-Doğrulanmış %54,9 %53,6 %54,4 %54,5 %51,1 %31,0

3.7 Flash’a kıyasla kazanımlar sırasıyla 2,4, 1,2 ve 1,3 puan. Finans ve hukuk sonuçları, Flash fiyat seviyesindeki bir modelin jeton başına birkaç kat daha pahalı Opus 5 ve GPT-5.6 Sol’un önüne geçebildiğini gösteriyor.

Bir gün önce yayınlanan Claude Fable 5.1 bu Google tablolarında yer almıyor. Üçlü karşılaştırma, mevcut en yakın yayınlanmış Opus 5 ve Sonnet 5 sonuçlarını kullanıyor.

Google ayrıca şu iddiaları paylaşıyor:

  • DeepSWE v1.1’de daha büyük öncü modelleri maliyetinin bir kısmına geride bırakıyor. 3.7 Flash bu değerlendirmede %65,3 puan almış olsa da 3.8 Flash yüzdesi yalnızca model kartındaki görsel tabloda yer alıyor.
  • Belge ağırlıklı uzun süreli iş akışlarında, 3.7 Flash’a kıyasla üç kattan fazla görev tamamlıyor.
  • Gray Swan istem enjeksiyonu testinde önemli bir sıçrama sağlıyor.
  • SWE-Bench Pro, Terminal-bench ve OSWorld sonuçları 3.8 Flash için metin olarak yayınlanmadı.

Bağımsız ölçümler de benzer bir tablo çiziyor. Artificial Analysis Intelligence Index’te:

  • Gemini 3.8 Flash: 59
  • Gemini 3.7 Flash: 56
  • Gemini 3.6 Flash: 52

3.8 Flash, GPT-5.6 Sol ve Grok 4.6 ile aynı seviyede; GPT-5.6 Terra, Claude Fable 5.1 ve Muse Spark 1.2’nin 57 puanlık sonuçlarının üzerinde yer alıyor.

τ³-Banking araç kullanımı değerlendirmesinde 3.8 Flash %45 puan aldı. Bu, 3.7 Flash’a göre 12 puanlık bir artış. Ancak 3.8 ve 3.7 Flash karşılaştırması, kazanımları iş yüküne göre artan jeton tüketimiyle birlikte değerlendirmek gerektiğini gösteriyor.

Fiyatlandırma: Jeton başına aynı, görev başına daha fazla

Google’ın fiyatlandırma sayfasına göre Gemini 3.8 Flash, 3.6 ve 3.7 Flash ile aynı fiyat satırında yer alıyor. Fiyatlar 1 Ocak 2027’de iki katına çıkacak.

Öğe 31 Aralık 2026’ya kadar 1 Ocak 2027’den itibaren
Giriş 0,75 ABD doları / 1 milyon jeton 1,50 ABD doları / 1 milyon jeton
Çıkış, düşünme dahil 3,75 ABD doları / 1 milyon jeton 7,50 ABD doları / 1 milyon jeton
Önbelleğe alınmış giriş 0,075 ABD doları / 1 milyon jeton 0,15 ABD doları / 1 milyon jeton
Önbellek depolama 0,50 ABD doları / 1 milyon jeton / saat 1,00 ABD doları / 1 milyon jeton / saat
Toplu giriş / çıkış 0,375 / 1,875 ABD doları 0,75 / 3,75 ABD doları

Dikkat edilmesi gereken iki nokta var:

Düşünme jetonları çıkış olarak faturalandırılır

Düşünme jetonları çıkış jetonlarıdır ve usageMetadata.thoughtsTokenCount alanında ayrı raporlanır. Bu nedenle yüksek seviyede kısa bir yanıt, düşük seviyede uzun bir yanıttan daha pahalı olabilir. Ayrıntılı örnekler Gemini 3.8 Flash fiyatlandırma dökümünde yer alıyor.

Google Arama’nın ayrı bir kullanım ölçeri vardır

Gemini 3.x modelleri arasında paylaşılan aylık 5.000 ücretsiz Google Arama isteğinden sonra her 1.000 istek için 14 ABD doları ücret alınır.

AI Studio ve API’de hız sınırlı ücretsiz bir katman bulunur. Google, ücretsiz katmandaki verilerin ürünlerini geliştirmek için kullanıldığını belirtir. Model başına hız sınırları belgelerde değil, AI Studio arayüzünde gösterilir.

Faturalandırma kademeleri şu şekilde açılır:

  • 1. Kademe: Faturalandırma hesabı bağlandıktan sonra
  • 2. Kademe: 100 ABD doları harcama ve üç gün sonra
  • 3. Kademe: 1.000 ABD doları harcama ve 30 gün sonra

Ücretsiz erişim kılavuzu, ücretsiz yolun sınırlarını; Toplu API kılavuzu ise bekleyebilecek işler için %50 indirimi açıklar.

Gemini 3.8 Flash API nasıl çağrılır?

Google, Gemini 3.x için artık Etkileşimler API’sini birincil yol olarak konumlandırıyor. generateContent eski kabul edilse de son kullanım tarihi olmadan tamamen desteklenmeye devam ediyor.

Basit bir Etkileşimler API isteği:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-[REDACTED CREDENTIAL] \
  -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"HTTP önbelleğe almayı 3 cümlede açıklayın.","generation_config":{"thinking_level":"medium"}}'
Enter fullscreen mode Exit fullscreen mode

Çok turlu konuşmalarda previous_interaction_id göndererek sunucunun önceki durumu korumasını sağlayabilirsiniz.

Fonksiyon çağırma akışı:

  1. Araçları JSON şemasıyla bildirin.
  2. Bir function_call adımı alın.
  3. call_id ve name alanlarını içeren bir function_result gönderin.

Bu iki alan Gemini 3.8 Flash için zorunludur. Eski generateContent API’sinde aynı değer id olarak adlandırılır. REST ve Python örnekleri için API kılavuzuna, yinelemeli araç döngülerini sınırlamak için de fonksiyon çağırma kılavuzuna bakın.

Gemini 3.7 Flash’tan geçiş

Geçiş küçük görünse de bazı ayarlar hataya neden olabilir:

  • minimal düşünme seviyesi reddedilir.
  • thinking_budget yerine thinking_level kullanılır.
  • candidate_count desteklenmez.
  • Google, temperature değerinin varsayılan 1.0 olarak bırakılmasını önerir. Daha düşük değerler döngüye veya performans düşüşüne neden olabilir.

Geçiş kılavuzu, değişiklikleri önceki ve sonraki JSON örnekleriyle birlikte kontrol listesine dönüştürüyor.

Gemini 3.8 Flash neleri desteklemiyor?

Model sayfasına göre desteklenmeyen özellikler:

  • Ses üretimi
  • Live API
  • Görsel üretimi
  • Gemini 3 modellerinde görsel segmentasyonu

Giriş olarak metin, görsel, video, ses ve PDF kabul edilse de çıkış yalnızca metindir. Ürününüz gerçek zamanlı ses veya görsel çıkış gerektiriyorsa Gemini 3.8 Flash tüm çözüm değil; muhakeme ve araç çağırma katmanıdır.

Yoğun muhakeme gerektirmeyen, ucuz ve yüksek hacimli metin iş yükleri için Gemini 3.5 Flash-Lite fiyat listesinde 0,30 / 2,50 ABD doları seviyesinde kalıyor.

Bunun dışındaki başlıca özellikler destekleniyor:

  • Fonksiyon çağırma
  • Yapılandırılmış çıktılar
  • Bağlam önbelleğe alma
  • Kod yürütme
  • Google Arama ve Haritalar tabanlama
  • Toplu API
  • Önizlemedeki Bilgisayar kullanımı

Gemini 3.8 Flash Cyber: Güvenlikli ikiz

Gemini 3.8 Flash Cyber aynı gün yayınlandı; ancak herkese açık bir kayıt süreci yok. Erişim yalnızca güvenilir hükümet yetkilileri, kritik altyapı operatörleri ve yazılım bakımcılarına açık olan Fairwind Programı üzerinden sağlanıyor.

Program; arka plan kontrolleri ve kimlik avına dayanıklı MFA gibi gereksinimler içeriyor. Herkese açık API, fiyatlandırma veya kendi kendine barındırma seçeneği bulunmuyor. Model, sınırlı Gemini 3.5 Flash Cyber pilot programının yerini aldı.

Google’ın paylaştığı iddialar:

  • 20 programlama dilinde gerçek dünya güvenlik açıklarını keşfetmede %70’in üzerinde başarı oranı
  • Chrome güvenlik ekibine göre, çok daha büyük en iyi ticari modellerden 2,6 kat daha fazla doğru Chrome güvenlik açığı yaması

Her iki sonuç da Google tarafından raporlandı. Uygunluk ve yükümlülükler için Gemini 3.8 Flash Cyber açıklayıcısını inceleyebilirsiniz.

Gemini 3.8 Flash isteklerini Apidog’da test etme

Bu modelde önemli metrik “istek başarılı oldu mu?” değil, “görev kaç jeton tüketti?” sorusudur. Apidog ile bunu uygulama koduna geçmeden ölçebilirsiniz.

Önerilen test akışı:

  1. GEMINI_API_KEY değerini ortam değişkeni olarak kaydedin.
  2. Etkileşimler API’si ve generateContent isteklerini uç nokta olarak oluşturun.
  3. HTTP 200 durumunu doğrulayın.
  4. Uygulamanızın kullandığı JSON alanlarını kontrol edin.
  5. usageMetadata.thoughtsTokenCount için bir üst sınır belirleyin.
  6. Aynı istemi low, medium ve high seviyelerinde çalıştırın.
  7. Seviye başına jeton ve süre dağılımını karşılaştırın.

Akış yanıtları SSE olarak oluşturulur. includeThoughts: true, düşünce özetlerini hata ayıklarken yardımcı olabilir. Ayrıntılar için SSE test kılavuzuna bakın.

Test senaryosunu günlük olarak planlayarak jeton tüketimindeki regresyonları faturaya yansımadan yakalayabilirsiniz. Başlamak için Apidog’u indirin.

Sıkça sorulan sorular

Gemini 3.8 Flash yeni bir model mi, yoksa 3.7 Flash güncellemesi mi?

DeepMind model kartına göre Gemini 3.7 Flash tabanlıdır. Aynı fiyat, hız ve bağlam penceresini koruyan; zorlu görevlerde daha fazla muhakeme ve araç çağırma adımı yürüten ayarlanmış bir halef olarak değerlendirebilirsiniz. 3.7 Flash tamamen desteklenmeye devam ediyor.

Neden 3.7 Flash’tan daha fazla jeton kullanıyor?

Bu davranış tasarım gereğidir. Google, uzun süreli ve karmaşık görevlerde daha fazla jeton kullanılabileceğini belirtiyor. Artificial Analysis yaklaşık %30 daha fazla çıkış jetonu ölçtü. Ekstra muhakeme gerektirmeyen rotalarda thinking_level değerini medium veya low olarak ayarlayın.

Bağlam penceresi ne kadar?

Gemini 3.8 Flash, 1.048.576 giriş jetonu ve 65.536 çıkış jetonu destekler. 31 Aralık 2026’ya kadar önbelleğe alınan girişin fiyatı milyon jeton başına 0,075 ABD dolarıdır.

Ücretsiz Gemini uygulamasında kullanılabilir mi?

Lansman kapsamı Gemini uygulamasını Google AI Pro ve Ultra aboneleri için listeliyor; ücretsiz uygulama katmanı için aynı bilgi verilmedi. Geliştiriciler AI Studio ve API’de hız sınırlı ücretsiz katmana erişebilir.

Claude Fable 5.1 ile karşılaştırması nasıl?

Artificial Analysis Intelligence Index’te Gemini 3.8 Flash 59, Claude Fable 5.1 ise 57 puan aldı.

Fiyat farkı daha büyük: Claude Fable 5.1, milyon jeton başına 10 ABD doları giriş ve 50 ABD doları çıkış fiyatına sahip. Bu, Gemini 3.8 Flash’ın tanıtım fiyatının yaklaşık 13 katıdır. Ancak görev başına daha fazla muhakeme jetonu kullandığınızda fark daralabilir.

Sonuç

Gemini 3.8 Flash, daha uzun düşünen bir Flash modelidir. Kazanım; ajanik kıyaslamalarda birkaç puan, araç kullanımında 12 puan ve zorlu görevlerde daha iyi tamamlanma oranı olarak görülüyor. Bedeli ise yüksek düşünme seviyesinde yaklaşık %30 daha fazla çıkış jetonu.

Karar için basit bir kural kullanabilirsiniz:

  • Ajanlarınız Gemini 3.7 Flash’ta zorlanıyorsa 3.8 Flash’ı deneyin.
  • Gecikme kritikse thinking_level: "low" kullanın.
  • Karmaşık ajan döngülerinde medium veya high seviyelerini tercih edin.
  • Jeton başına değil, görev başına maliyet ölçün.
  • Her üretim rotası için thoughtsTokenCount sınırı belirleyin.

API kılavuzuyla başlayın, ilk isteğinizi Apidog’da çalıştırın ve düşünme seviyesini lansman iddiaları yerine kendi iş yükünüzün ölçümlerine göre seçin.

Top comments (0)