DEV Community

Cover image for Gemini 4 Argon ve Gemini 3.8 Flash Karşılaştırması: Argon'u Beklemeli mi, Flash ile Hemen mi Başlamalı?
Tobias Hoffmann
Tobias Hoffmann

Posted on Originally published at apidog.com

Gemini 4 Argon ve Gemini 3.8 Flash Karşılaştırması: Argon'u Beklemeli mi, Flash ile Hemen mi Başlamalı?

Gemini 3.8 Flash bugün kullanıma sunuldu: Ücretsiz katmanı olan, 2026-12-31 tarihine kadar 1 milyon jeton başına 0,75 dolar giriş ve 3,75 dolar çıkış fiyatıyla, ardından 1,50 dolar ve 7,50 dolar fiyatla, 64K çıkış sınırı olan kararlı bir model. Gemini 4 Argon ise değil. Google'ın tanıtım gönderisi, bunu belirtilmeyen uzunlukta bir giriş döneminde 2 ve 10 dolar, ardından 4 ve 20 dolar olarak fiyatlandırıyor. Google, çıkış sınırının 1 milyon jeton olduğunu ve bugün yalnızca Fairwind Programı savunucularına sunulduğunu belirtiyor. Bu çeyrekte yayın yapmanız gerekiyorsa, Flash'ı kullanın ve Argon'u tek bir yapılandırma değişikliği kadar uzakta tutun.

Apidog'u bugün deneyin

Bu gönderi, iki modeli özellikler, her iki tanıtım gönderisinde de yer alan kıyaslama satırları, siber puanlar ve özdeş bir çağrının maliyeti açısından karşılaştırır; ardından uygulanabilir bir karar kuralı sunar. Arka plan için Gemini 4 Argon'un ne olduğunu ve Gemini 3.8 Flash'ın ne olduğunu inceleyebilirsiniz. Son bölüm, geçişi tek bir değişken haline getiren Apidog kurulumunu gösterir.

Yan yana: Bugün neler çağırabilirsiniz

Gemini 3.8 Flash Gemini 4 Argon
Kullanılabilirlik Gemini API, AI Studio, Antigravity ve Gemini Enterprise üzerinde kararlı Fairwind Programı ortaklarının bir alt kümesine, Gemini Enterprise üzerinde yönetilen bir model olarak
Model Kimliği gemini-3.8-flash Yayınlanmadı
1 milyon jeton başına fiyat (giriş / çıkış) 2026-12-31 tarihine kadar 0,75 $ / 3,75 $, ardından 1,50 $ / 7,50 $ 2 $ / 10 $ giriş (bitiş tarihi belirtilmedi), ardından 4 $ / 20 $
1 milyonda önbelleğe alınmış giriş 0,075 $, ardından 0,15 $ 0,10 $ giriş, ardından 0,20 $ (girişte %95 indirim)
Çıkış sınırı 65.536 jeton 1 milyon jeton (Google'ın belirttiği sınır)
Giriş penceresi 1.048.576 jeton Yayınlanmadı
Düşünme seviyeleri low, medium (varsayılan), high; minimal HTTP 400 döndürür Belgelenmemiş
Ücretsiz API katmanı Evet, hız sınırlı Duyurulmadı
Tüketici erişimi AI Pro ve Ultra'da Gemini uygulaması, Arama'da AI Modu Henüz değil; AI Ultra aboneleri ilk dalgada, tarih yok

Birkaç hücrenin bağlama ihtiyacı var:

  • Google, Argon'un kendi uzun bağlam değerlendirmesinde 1 milyon jetona kadar istemler kullanmasına rağmen giriş penceresini yayınlamadı.
  • Google, Argon'un çıkış sınırının 1 milyon jeton olduğunu söylüyor; en az bir üçüncü taraf değerlendirici olan Vals AI, test ettiği yapılandırma için 262K maksimum çıkış listeliyor.
  • Argon'un değerlendirmeleri “en yüksek düşünme ayarlarıyla” çalıştı. Bu nedenle yüksek bir seviye muhtemelen mevcut, ancak Google seviyeleri veya varsayılanı adlandırmadı.
  • Flash'ın seviyeleri Google'ın düşünme belgelerinde ve 3.8 Flash düşünme seviyeleri kılavuzumuzda yer alır.

Flash'ın ücretsiz katmanı hız sınırlıdır ve Google, ücretsiz katman verilerinin “ürünlerimizi iyileştirmek için kullanıldığını” belirtir. Google, Argon'u kullanmanın ücretsiz bir yolunu açıklamadı. Bugün kullanabileceğiniz alternatifler için Argon ücretsiz erişim açıklayıcımıza bakın.

Her iki tanıtım gönderisinin de metinde paylaştığı kıyaslama satırları

Google'ın iki model için tanıtım tabloları metinde iki satırı paylaşır. Bunlar Google tarafından bildirilen sayılardır ve Argon'un metodolojisi her iki satırı da Vals AI'ya atfeder.

Kıyaslama Gemini 3.8 Flash (2 Eylül tablosu) Gemini 4 Argon (30 Eylül tablosu)
Vals Finans Aracısı v2 %61,4 %65,4
Harvey Yasal Aracı Kıyaslaması %10,0 %19,6

Google bu tabloları bir ay arayla ve farklı rakip setlerine karşı yayınladı. Bu nedenle farkı kontrollü bir test olarak değil, yönsel bir sinyal olarak okuyun.

Yine de yasal satır dikkat çekicidir: Argon'un %19,6'sı, Flash'ın %10,0'unun neredeyse iki katıdır. Finansal fark ise 4 puandır.

Argon'un tablosundaki diğer her şeyin metinde 3.8 Flash karşılığı yoktur. Google'ın 3.8 Flash tablosu HLE Doğrulanmış verilerini bildiriyordu, Argon'unki bunu yapmıyor. Flash'ın DeepSWE puanı yalnızca model kartı görsellerinde yer alıyordu.

Üçüncü taraf sıralaması olan Arena'nın Metin liderlik tablosunda, ön oylamalarda Argon (Yüksek) 1. sırada yer alırken Gemini 3.8 Flash (Yüksek) 11. sıradadır. Her satırın ölçüm kaynağını içeren 19 satırlık Argon tablosunun tamamı Argon kıyaslama analizimizde bulunur.

Siber: Argon ve 3.8 Flash Siber

DeepMind siber sayfası, Argon'u Flash'ın Fairwind tarafından korunan siber kardeşi Gemini 3.8 Flash Siber ile karşılaştırır:

Siber değerlendirme Gemini 4 Argon Gemini 3.8 Flash Siber
Gerçek dünya güvenlik açığı keşfi %85,8 %71,0
Wiz Sızma Testi Kıyaslaması %70,9 %58,2

Her iki modelin de erişimi kısıtlıdır. Gemini 3.8 Flash Siber, Gemini Enterprise Ajan Platformunda bir izin listesinin arkasında Genel Kullanıma (GA) sunulmuştur; Argon ise yalnızca Fairwind içindir.

Fairwind ortağı değilseniz, bu sayılar bugün çağırabileceğiniz modeli değiştirmez. Üzerine inşa edebileceğiniz model genel 3.8 Flash modelidir.

Her ikisinde de aynı çağrının maliyeti

100.000 giriş jetonu ve 8.000 çıkış jetonu içeren bir çağrı ele alalım. Mevcut Gemini modelleri, 3.8 Flash dahil, düşünme jetonlarını çıkış olarak faturalandırır. Bu nedenle 8.000 sayısı düşünme jetonlarını da içerir.

Google, Argon'un düşünme jetonlarını nasıl faturalandırdığını açıklamadı. Aşağıdaki Argon satırları, mevcut Gemini modelleriyle aynı yaklaşımı izlediğini varsayar.

Model ve dönem Giriş maliyeti Çıkış maliyeti Çağrı başına toplam
3.8 Flash, giriş 0,1M x 0,75 $ = 0,075 $ 0,008M x 3,75 $ = 0,030 $ 0,105 $
3.8 Flash, 2027-01-01'den itibaren 0,1M x 1,50 $ = 0,150 $ 0,008M x 7,50 $ = 0,060 $ 0,210 $
Argon, giriş 0,1M x 2 $ = 0,200 $ 0,008M x 10 $ = 0,080 $ 0,280 $
Argon, standart 0,1M x 4 $ = 0,400 $ 0,008M x 20 $ = 0,160 $ 0,560 $

Argon'un jeton başına oranları, hem giriş fiyatlandırmasında hem de standart fiyatlandırmada Flash'ın 8/3'ü, yani yaklaşık 2,67 katıdır.

Günde bu çağrılardan 1.000 adet yaparsanız:

  • Flash giriş fiyatıyla: günlük 105 $
  • Argon giriş fiyatıyla: günlük 280 $

Bu oranı değiştirebilecek üç durum vardır:

  1. Jeton sayıları eşleşmeyebilir. Aynı istem, farklı modellerde farklı çıktı ve düşünme jetonu sayıları üretebilir. Argon'un yayınlanmış değerlendirmeleri en yüksek düşünme ayarlarında çalıştı. 3.8 Flash için Google, daha yüksek çaba seviyelerinin daha fazla jeton kullanabileceğini belirtiyor.

  2. Uzun çıktılar hesabı değiştirir. 200.000 jetonluk bir yanıt Flash'ın 65.536 jetonluk kapasitesine sığmaz; bunu birden fazla çağrıya bölmeniz gerekir. Argon'un belirtilen sınırına göre ise tek yanıt olabilir:

    • Giriş fiyatıyla: 0,2M x 10 $ = 2,00 $
    • Standart fiyatla: 0,2M x 20 $ = 4,00 $

Tam 1 milyon jetonluk bir yanıt, giriş fiyatıyla 10 $, standart fiyatla ise 20 $ tutar.

  1. Yalnızca bir giriş bitiş tarihi biliniyor. Flash'ın giriş fiyatlandırması 2026-12-31'de sona eriyor. Google, Argon'un giriş fiyatının ne zaman biteceğini belirtmedi.

Flash ayrıca Gemini API fiyatlandırma sayfasına göre %50 indirimli Toplu İş sunar: 31 Aralık'a kadar 0,375 $ giriş ve 1,875 $ çıkış. Google, Argon için Toplu İş fiyatlandırmasını yayınlamadı.

Daha fazla ayrıntı için Argon fiyatlandırma kılavuzumuza ve 3.8 Flash fiyatlandırma kılavuzumuza bakın.

Argon'u mu beklemelisiniz, yoksa Flash'ı mı kullanmalısınız?

Şu durumlarda 3.8 Flash'ı hemen kullanın

  • Maliyet kısıtlamalarınız varsa: Flash, Argon'un jeton başına yaklaşık 3/8 maliyetindedir ve Toplu İş bunu yarıya indirir.
  • Yüksek hacimli çalışıyorsanız: Sınıflandırma, çıkarma, yönlendirme ve sohbet gibi iş yüklerinde maliyet farkı hızla büyür.
  • Bugün yayın yapmanız gerekiyorsa: Flash'ın kararlı bir model kimliği, prototipleme için ücretsiz katmanı ve yayınlanmış fiyat çizelgesi vardır.
  • Yanıtlarınız 65.536 jetona sığıyorsa: Çoğu API iş yükü bu sınırın altında kalır.

Şu durumlarda Argon'u planlayın

  • Çalışma uzun vadeli ise: Google, Argon'un “karmaşık, uzun vadeli iş akışlarında derinlemesine muhakemeyi sürdürmek için” tasarlandığını belirtiyor.
  • 64K'dan fazla çıktıya ihtiyacınız varsa: Tam modül yeniden yazımları, uzun raporlar ve büyük geçişler 1 milyonluk çıkış sınırından yararlanabilir.
  • Yasal veya finansal aracılar kullanıyorsanız: Google'ın iki model için ortak yayınladığı satırlarda Argon öndedir.
  • Fairwind için uygunsanız: Argon, programın şu anda öne çıkardığı modeldir.

Tek seferlik bir seçim yapmak zorunda değilsiniz. Trafiğin büyük kısmını Flash'a yönlendirin; Argon yayınlandığında zorlu istekleri aynı yapılandırma katmanının arkasından Argon'a taşıyın.

Bir kaydedilmiş istek, iki model

Model adını ortam değişkeninde tutun. İsteklerinizi şimdi 3.8 Flash ile çalıştırın. Argon'un model kimliği yayınlandığında yalnızca değişkeni güncelleyin.

Google Argon kimliğini yayınlamadı; bir model kimliği tahmin etmeyin.

MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"

curl -s -X POST \
  "https://generativelanguage.googleapis.com/v1beta/models/${MODEL}:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {
        "parts": [
          {
            "text": "Bu sözleşme maddesini 3 madde halinde özetle."
          }
        ]
      }
    ],
    "generationConfig": {
      "thinkingConfig": {
        "thinkingLevel": "medium"
      },
      "maxOutputTokens": 8192
    }
  }'
Enter fullscreen mode Exit fullscreen mode

Uygulama tarafında şu adımları izleyin:

  1. GEMINI_API_KEY ve GEMINI_MODEL değişkenlerini tanımlayın.
  2. İsteği Apidog içinde kaydedin.
  3. Durum kodu için 200 kontrolü ekleyin.
  4. Uygulamanızın kullandığı yanıt alanları için doğrulamalar ekleyin.
  5. Maliyet bütçenize göre usageMetadata.thoughtsTokenCount için üst sınır tanımlayın.
  6. Uzun yanıtların bütçeyi aşmasını önlemek için maxOutputTokens değerini sabit bir sınırda tutun.
  7. İsteği test senaryosuna ekleyin, Flash üzerinde çalıştırın ve raporu temel karşılaştırma olarak saklayın.

Her generateContent yanıtı usageMetadata içerir. Model değiştirirken yalnızca metin kalitesini değil, giriş, çıkış ve düşünme jetonu kullanımını da karşılaştırın.

Lansman günü için iki uyarı var:

  • Google, “tüm yeni modellerin” Interactions API'sinde başlatılacağını belirtiyor. Argon'un generateContent desteği açıklanmadı. Bu nedenle ayrıca POST https://generativelanguage.googleapis.com/v1beta/interactions kullanan bir Etkileşimler isteği kaydedin ve düşünme yapılandırmasını generation_config.thinking_level ile yönetin.
  • Argon'un düşünme seviyesi adları belgelenmedi. Bu nedenle Flash'taki medium değeri Argon'a doğrudan taşınmayabilir.

Argon geldiğinde model değişkenini güncelleyin, aynı testi tekrar çalıştırın ve çıktıları ile usageMetadata verilerini yan yana karşılaştırın.

Sıkça Sorulan Sorular

Gemini 4 Argon, Gemini 3.8 Flash'tan daha iyi mi?

Her iki tanıtım tablosunun metinde paylaştığı iki satırda evet: Vals Finans Aracısı v2'de %65,4'e karşı %61,4 ve Harvey Yasal Aracı Kıyaslamasında %19,6'ya karşı %10,0. Ancak Argon jeton başına yaklaşık 2,67 kat daha pahalıdır ve henüz genel olarak çağrılamaz.

Gemini 4 Argon'u beklemeli miyim?

Yayın yapmanız gerekiyorsa hayır. Google yayın tarihi vermedi; yalnızca ücretli API müşterileri ve AI Ultra aboneleriyle başlayarak “mümkün olan en kısa sürede” sunulacağını belirtti.

Yeni bir proje için Gemini 3.8 Flash mı yoksa Argon mu?

Modeli bir değişkende tutarak 3.8 Flash ile başlayın. Uzun çıktılar veya yasal ve finansal iş akışları gerektiren istekleri, kendi istemlerinizle test ettikten sonra Argon'a taşıyın.

Argon'u ücretsiz kullanmanın bir yolu var mı?

Hayır. Google ücretsiz bir katman duyurmadı. Bugün kullanabileceğiniz ücretsiz Gemini modelleri için Argon ücretsiz erişim açıklayıcımıza bakın.

Argon, Gemini 3.8 Flash'ın yerini mi alıyor?

Google bunu söylemedi. Google, Argon'u yeni sınır modeli olarak adlandırıyor ve Reuters önceki Pro serisinden daha büyük olduğunu bildiriyor. Bu nedenle Flash'tan farklı bir katmanda değerlendirilmelidir.

Sonraki adım

İsteği bugün ayarlayın, 3.8 Flash üzerinde çalıştırın ve test raporunu kaydedin. Argon yayınlandığında, kendi trafiğinizde ek maliyetini hak edip etmediğini birkaç dakika içinde ölçebilirsiniz.

Karşılaştırmayı oluşturmak için Apidog'u indirin.

Top comments (0)