DEV Community

Cover image for Gemini 4 Argon Fiyatları: 2$/10$ Başlangıç, 4$/20$ Sonrası ve 1 Milyon Token Cevap Maliyeti
Tobias Hoffmann
Tobias Hoffmann

Posted on Originally published at apidog.com

Gemini 4 Argon Fiyatları: 2$/10$ Başlangıç, 4$/20$ Sonrası ve 1 Milyon Token Cevap Maliyeti

Gemini 4 Argon, giriş dönemi boyunca 1 milyon giriş belirteci (input token) için 2 dolar, 1 milyon çıkış belirteci (output token) için 10 dolar ücretlendiriliyor. Giriş dönemi sonrasında bu fiyatlar sırasıyla 4 dolar ve 20 dolar olacak. Önbelleğe alınmış girişler (cached input), giriş fiyatından %95 indirimli: giriş döneminde 1 milyon belirteç başına 0,10 dolar, sonrasında 0,20 dolar. Google, giriş döneminin bitiş tarihini açıklamadı. Argon henüz genel kullanıma açık değil; şu anda yalnızca Fairwind Programı siber savunucularına sunuluyor.

Apidog'u bugün deneyin

Bu yazı, Argon fiyat listesini uygulanabilir bütçe hesaplarına dönüştürür: mevcut modellerle karşılaştırma, dört maliyet senaryosu, görev başına maliyet farkları ve şimdiden kurabileceğiniz maliyet kontrolleri. Model hakkında genel bilgi için Gemini 4 Argon nedir, erişim durumu için Gemini 4 Argon ücretsiz mi yazılarına bakın. Bugün çağırabildiğiniz bir model üzerinde Apidog ile maliyet kontrollerinizi oluşturup Argon yayınlandığında yalnızca model değişkenini değiştirebilirsiniz.

Gemini 4 Argon fiyatlandırma görseli

Fiyat listesi

Google, oranları Gemini 4 Argon tanıtım gönderisinde yayımladı. Dipnotta, giriş dönemi sonrasında 1 milyon giriş belirteci için 4 dolar ve 1 milyon çıkış belirteci için 20 dolar uygulanacağı belirtiliyor.

Gemini 4 Argon — 1 milyon belirteç başına Giriş dönemi Standart (giriş sonrası)
Giriş $2,00 $4,00
Önbelleğe alınmış giriş $0,10 $0,20
Çıkış $10,00 $20,00
Yanıt başına maksimum çıkış (Google) 1 milyon 1 milyon
Tam 1 milyon belirteçlik çıkış maliyeti $10,00 $20,00

Önbelleğe alınmış giriş fiyatı, Google'ın belirttiği %95 indirimden türetilir:

Giriş dönemi:  $2,00 × 0,05 = $0,10 / 1 milyon belirteç
Standart:      $4,00 × 0,05 = $0,20 / 1 milyon belirteç
Enter fullscreen mode Exit fullscreen mode

Google henüz giriş bağlam penceresini veya model kimliğini yayımlamadı. Çıkış sınırını önceki 64K sınırından artırarak 1 milyon belirteç olarak açıklıyor. Ancak üçüncü taraf bir değerlendirici olan Vals AI, test ettiği yapılandırma için 262K maksimum çıkış listeliyor.

Argon ve mevcut modellerin fiyat karşılaştırması

Tüm fiyatlar 1 milyon belirteç başınadır.

Model Giriş Önbelleğe alınmış giriş Çıkış Maks. çıkış
Gemini 4 Argon (giriş) $2 $0,10 $10 1 milyon
Gemini 4 Argon (standart) $4 $0,20 $20 1 milyon
GPT-6 Astra $10 $1 $50 128.000
Claude Opus 5.5 $4 $0,20 $20 128K (Batch'te 300K, beta)
Claude Sonnet 5.5 $2 $0,20 $10 128K (Batch'te 300K, beta)
GPT-6.1 Sol $2 $0,10 $10 128.000
Claude Fable 5.1 $10 $0,25 $50 128K
gemini-3.1-pro-preview (istem <=200K / >200K) $2 / $4 $0,20 / $0,40 $12 / $18 65.536
gemini-3.8-flash (giriş / 2027-01-01'den itibaren) $0,75 / $1,50 $0,075 / $0,15 $3,75 / $7,50 65.536

Rakip fiyatları için satıcı belgelerini kullanın:

Pratik karşılaştırma:

  • Standart Argon, Claude Opus 5.5 ile aynı fiyatta: $4 giriş, $0,20 önbellekli giriş ve $20 çıkış.
  • Giriş dönemi Argon, Claude Sonnet 5.5 ve GPT-6.1 Sol ile aynı $2/$10 oranında.
  • GPT-6 Astra ve Claude Fable 5.1, giriş dönemi Argon'dan 5 kat; standart Argon'dan 2,5 kat pahalıdır. Ayrıntı için Claude Fable 5.1 fiyatlandırması yazısına bakın.
  • Argon'un giriş dönemi çıkış fiyatı ($10), gemini-3.1-pro-preview çıkış fiyatının ($12) altındadır.
  • Uzun istemler fiyatı değiştirebilir. OpenAI, 272K giriş belirtecini aşan isteklerde tüm çağrı için giriş ve önbellek oranlarını 2 kat, çıkış oranını 1,5 kat uygular. Gemini 3.1 Pro, 200K üzeri istemlerde daha yüksek oran kullanır. Anthropic'te bu tür bir kademe yoktur. Google, Argon için uzun istem kademesi açıklamadı.

Yetenek karşılaştırması için Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5 yazısına bakın.

Düşünme belirteçlerini çıkış maliyetine dahil edin

Mevcut Gemini modellerinde düşünme belirteçleri çıkış olarak faturalandırılır. Google'ın düşünme belgeleri, yanıt fiyatlandırmasının çıktı ve düşünme belirteçlerinin toplamı olduğunu belirtir.

Google, Argon için bunu ayrıca belgelemedi. Ancak bütçe oluştururken şu varsayımı kullanın:

faturalandırılan_çıkış = yanıt_belirteçleri + düşünme_belirteçleri
Enter fullscreen mode Exit fullscreen mode

Google, Argon değerlendirmelerini “en yüksek düşünme ayarlarıyla” çalıştırdığını belirtti. Bu nedenle $10 / 1 milyon çıkış belirteci ifadesini yalnızca görünür yanıt değil, yanıt ve muhakeme toplamı olarak değerlendirin.

Dört maliyet senaryosu

Temel formül:

maliyet = (giriş_belirteçleri / 1.000.000 × giriş_oranı)
        + (çıkış_belirteçleri / 1.000.000 × çıkış_oranı)
Enter fullscreen mode Exit fullscreen mode

İlk üç senaryo önbelleğe alma kullanılmadığını varsayar.

1. Tipik API çağrısı: 20K giriş, 5K çıkış

Giriş dönemi:

20.000 / 1.000.000 × $2  = $0,04 giriş
5.000 / 1.000.000 × $10  = $0,05 çıkış
Toplam                    = $0,09
Enter fullscreen mode Exit fullscreen mode

Standart fiyat:

20.000 / 1.000.000 × $4  = $0,08 giriş
5.000 / 1.000.000 × $20  = $0,10 çıkış
Toplam                    = $0,18
Enter fullscreen mode Exit fullscreen mode

Günde 1.000 çağrı için:

Fiyat dönemi Günlük maliyet
Giriş dönemi $90
Standart $180

Aynı çağrının karşılaştırmalı maliyetleri:

Model Tahmini çağrı maliyeti
Gemini 4 Argon — giriş dönemi $0,09
Gemini 4 Argon — standart $0,18
Claude Opus 5.5 $0,18
GPT-6 Astra $0,45
gemini-3.1-pro-preview $0,10
gemini-3.8-flash — giriş fiyatı Yaklaşık $0,034

2. Uzun aracı dönüşü: 200K giriş, 50K çıkış

Araç çağrıları, belge bağlamı ve önceki mesajlar uzun istem maliyetini hızla büyütebilir.

Giriş dönemi:

200.000 / 1.000.000 × $2  = $0,40 giriş
50.000 / 1.000.000 × $10  = $0,50 çıkış
Toplam                     = $0,90
Enter fullscreen mode Exit fullscreen mode

Standart fiyat:

200.000 / 1.000.000 × $4  = $0,80 giriş
50.000 / 1.000.000 × $20  = $1,00 çıkış
Toplam                     = $1,80
Enter fullscreen mode Exit fullscreen mode

Karşılaştırma:

  • GPT-6 Astra: $4,50 ($2,00 + $2,50)
  • gemini-3.1-pro-preview: $1,00 ($0,40 + $0,60)

Ancak 200K, Gemini 3.1 Pro'nun kademe sınırıdır. Daha uzun istemlerde $4/$18 oranı uygulanır. Argon benzer bir kademe kullanırsa, uzun bağlamlı aracı iş akışları daha pahalı olabilir.

3. Tek maksimum yanıt: 1 milyon çıkış belirteci

Giriş maliyeti hariç yalnızca çıkış:

Fiyat dönemi 1 milyon çıkış maliyeti
Giriş dönemi $10,00
Standart $20,00

Çağrıya 100K belirteçlik istem eklenirse:

Fiyat dönemi Giriş Çıkış Toplam
Giriş dönemi $0,20 $10,00 $10,20
Standart $0,40 $20,00 $20,40

Tablodaki diğer modeller tek bir senkronize yanıtta bu çıkış boyutuna ulaşamaz: çoğu 128K, önceki Gemini Pro ise 65.536 belirteç ile sınırlıdır.

Vals AI'ın listelediği 262K maksimum çıkış için tam yanıt maliyeti:

Giriş dönemi: 262.000 / 1.000.000 × $10 = $2,62
Standart:     262.000 / 1.000.000 × $20 = $5,24
Enter fullscreen mode Exit fullscreen mode

Zaman aşımı, akış ve ağ geçidi ayarları için Gemini 4 Argon'un 1 milyon çıkış belirteçleri yazısını inceleyin.

4. 500K belirteçlik istemi 10 kez önbellekten kullanmak

500K belirteçlik aynı kod tabanını veya sözleşme setini 10 kez gönderdiğinizi ve her çağrıda 5K çıkış aldığınızı varsayalım.

Varsayımlar:

  1. İlk çağrı, önbelleği oluşturmak için tam giriş fiyatını öder.
  2. Sonraki 9 çağrı, önbelleğe alınmış giriş oranını kullanır.
  3. Her çağrı 5K çıkış üretir.
10 çağrı, 500K istem, her biri 5K çıkış Giriş dönemi Standart
Giriş, önbelleğe alma yok (10 × 500K) $10,00 $20,00
Giriş, önbelleğe alınmış (1 tam + 9 önbellekli) $1,00 + 9 × $0,05 = $1,45 $2,00 + 9 × $0,10 = $2,90
Çıkış (10 × 5K) $0,50 $1,00
Önbelleğe alma ile toplam $1,95 $3,90
Önbelleğe alma olmadan toplam $10,50 $21,00

Bu örnekte önbelleğe alma, giriş maliyetini %85,5 azaltır.

Dikkat edilmesi gerekenler:

  • Google, Argon için önbellek depolama ücreti açıklamadı.
  • gemini-3.1-pro-preview, önbellek depolama için saatte 1 milyon belirteç başına $4,50 ücret alır. Bu oranla 500K belirteci bir saat tutmak $2,25 ek maliyet oluşturur.
  • 500K istem, Gemini 3.1 Pro'nun 200K sınırını aşar.
  • Argon'un standart önbellek oranı, Claude Opus 5.5 ile aynı: $0,20. Bu nedenle Claude Opus 5.5 istem önbellekleme maliyet matematiği içindeki başa baş yaklaşımını kullanabilirsiniz.

Belirteç başına fiyat, görev başına maliyet değildir

Düşük token fiyatı, her zaman düşük görev maliyeti anlamına gelmez. Asıl değişken, modelin görev başına tükettiği giriş, çıkış ve düşünme belirteçleridir.

Artificial Analysis, Gemini 4 Argon (Yüksek) için Intelligent Index çalıştırmasında giriş fiyatıyla görev başına $1,99 listeliyor. The Decoder aynı çalıştırmayı standart fiyatlarla görev başına $3,98 olarak belirtiyor.

Artificial Analysis verilerinde:

  • Argon (Yüksek): görev başına yaklaşık 62K çıkış belirteci
  • GPT-6 Astra (maksimum): görev başına yaklaşık 27K çıkış belirteci

Yalnızca çıkış maliyeti üzerinden:

Argon giriş dönemi:
62.000 / 1.000.000 × $10 = $0,62

GPT-6 Astra:
27.000 / 1.000.000 × $50 = $1,35
Enter fullscreen mode Exit fullscreen mode

Argon'un standart oranları Astra'dan %60 düşük olsa da, daha fazla belirteç üretmesi toplam görev maliyetini değiştirebilir.

Vals AI da benzer bir fark gösteriyor:

Model Vals Index test başına maliyet
Gemini 4 Argon $15,68
Claude Opus 5.5 $32,14
Claude Sonnet 5.5 $21,34
GPT-6.1 Sol $3,24

Claude Sonnet 5.5 ve GPT-6.1 Sol, Argon'un giriş dönemi fiyatına yakın görünse de test başına maliyetleri 6 kattan fazla farklılık gösterebilir.

Sonuç: Bütçeyi yalnızca fiyat listesinden değil, kendi üretim trafiğinizin token telemetrilerinden oluşturun.

Argon yayınlanmadan önce maliyet kontrolleri kurun

1. Çıkış üst sınırı belirleyin

generateContent kullanıyorsanız generationConfig.maxOutputTokens ile bir üst sınır uygulayın.

{
  "generationConfig": {
    "maxOutputTokens": 8000
  }
}
Enter fullscreen mode Exit fullscreen mode

Google, yeni modellerin Interactions API'de yayınlandığını belirtiyor. Argon için belgelenen eşdeğer alanı kullanın.

Bu kontrol önemlidir çünkü 1 milyonluk teorik üst sınır, standart fiyatla çağrı başına yalnızca çıkış için $20 demektir.

2. Sabit bağlamı önbelleğe alın

Önbelleğe alma için iyi adaylar:

  • Sistem talimatları
  • Araç şemaları
  • API sözleşmeleri
  • Tekrarlanan teknik belgeler
  • Büyük kod tabanı bağlamı
  • Her çağrıda yeniden gönderilen referans verileri

Her çağrıda değişen kullanıcı girdisini önbelleğe alınmış sabit içerikten ayırın. Böylece %95 giriş indirimi, tekrar eden iş yüklerinde doğrudan maliyet avantajı sağlar.

3. Düşünme seviyesini ölçerek seçin

Google henüz Argon'un düşünme seviyelerini açıklamadı. Mevcut modellerde:

  • gemini-3.1-pro-preview: varsayılan yüksek
  • gemini-3.8-flash: varsayılan orta

Argon seçenekleri yayımlandığında aynı görev setini farklı düşünme seviyelerinde çalıştırın. Kalite korunuyorsa daha düşük seviye, çıkış ve düşünme belirteci maliyetini azaltabilir.

4. usageMetadata üzerinden maliyet iddiası ekleyin

Her generateContent yanıtındaki usageMetadata alanını kaydedin. Modeli ortam değişkeniyle yönetin:

GEMINI_MODEL=gemini-3.8-flash
Enter fullscreen mode Exit fullscreen mode

Argon yayınlandığında yalnızca bu değeri güncelleyin:

GEMINI_MODEL=gemini-4-argon
Enter fullscreen mode Exit fullscreen mode

Maliyet hesabı:

maliyet = önbelleğe_alınmamış_giriş / 1.000.000 × giriş_oranı
        + önbelleğe_alınmış_giriş   / 1.000.000 × önbellek_oranı
        + (çıkış + düşünme) / 1.000.000 × çıkış_oranı
Enter fullscreen mode Exit fullscreen mode

Örnek JavaScript maliyet hesaplayıcısı:

const pricing = {
  launch: {
    input: 2,
    cachedInput: 0.10,
    output: 10
  },
  standard: {
    input: 4,
    cachedInput: 0.20,
    output: 20
  }
};

function calculateCost(usageMetadata, phase = "launch") {
  const rates = pricing[phase];

  const inputTokens = usageMetadata.promptTokenCount ?? 0;
  const cachedTokens = usageMetadata.cachedContentTokenCount ?? 0;
  const outputTokens = usageMetadata.candidatesTokenCount ?? 0;
  const thoughtsTokens = usageMetadata.thoughtsTokenCount ?? 0;

  const uncachedInputTokens = Math.max(inputTokens - cachedTokens, 0);

  return (
    (uncachedInputTokens / 1_000_000) * rates.input +
    (cachedTokens / 1_000_000) * rates.cachedInput +
    ((outputTokens + thoughtsTokens) / 1_000_000) * rates.output
  );
}
Enter fullscreen mode Exit fullscreen mode

Ardından bütçe sınırı koyun:

const cost = calculateCost(response.usageMetadata, "launch");
const maxCostPerRequest = 0.25;

if (cost > maxCostPerRequest) {
  throw new Error(
    `Çağrı maliyeti bütçeyi aştı: $${cost.toFixed(4)} > $${maxCostPerRequest}`
  );
}
Enter fullscreen mode Exit fullscreen mode

Apidog içinde isteği GEMINI_MODEL ortam değişkeniyle kaydedin, usageMetadata değerlerini maliyete dönüştüren yanıt sonrası bir iddia ekleyin ve çağrı bütçe sınırını aşarsa testi başarısız yapın. Bugün gemini-3.8-flash üzerinde çalıştırabilir, Argon model kimliği geldiğinde tek değişkenle aynı paketi yeniden kullanabilirsiniz.

Google'ın henüz açıklamadığı fiyatlandırma detayları

Aşağıdaki bilgiler henüz yayımlanmadı:

  • Giriş döneminin süresi ve standart $4/$20 oranının başlayacağı tarih
  • 200K üzerindeki istemler için ek fiyat kademesi
  • Batch veya Flex fiyatlandırması
  • Önbellek depolama ücretleri
  • Hız limitleri
  • Ücretsiz katman olup olmayacağı

Gemini 3.1 Pro için Batch ve Flex seçenekleri bulunuyor; oranlar girişte $1/$2, çıkışta $6/$9. Ancak Argon için aynı seçeneklerin sunulacağı doğrulanmadı.

Sıkça sorulan sorular

Gemini 4 Argon'un 1 milyon belirteç başına maliyeti ne kadar?

Giriş döneminde 1 milyon giriş belirteci için $2, 1 milyon çıkış belirteci için $10. Sonrasında oranlar $4 ve $20. Önbelleğe alınmış giriş, %95 indirimli olarak sırasıyla $0,10 ve $0,20.

Giriş fiyatı ne kadar sürecek?

Google süre veya bitiş tarihi açıklamadı.

Düşünme belirteçleri çıkış olarak faturalandırılır mı?

Mevcut Gemini modellerinde evet. Google, Argon için bunu ayrıca belgelemediği için bütçe hesaplarında dahil etmek gerekir.

1 milyon belirteçlik çıkış yanıtı ne kadara mal olur?

Giriş hariç, giriş döneminde $10; standart fiyatla $20.

Argon, Claude Opus 5.5 veya GPT-6 Astra'dan daha mı ucuz?

Token başına standart Argon, Claude Opus 5.5 ile aynı fiyatta ve GPT-6 Astra'dan %60 daha düşük oranlıdır. Ancak görev başına maliyet, modelin ürettiği toplam token miktarına bağlıdır. Daha düşük maliyetli bir Gemini seçeneği için Gemini 3.8 Flash fiyatlandırması yazısına bakın.

Argon için bugün ödeme yapabilir miyim?

Hayır. Şu anda yalnızca Fairwind Programı ortaklarına sunuluyor. Ücretli API müşterileri ve Google AI Ultra aboneleri için erişim daha sonra gelecek, ancak tarih açıklanmadı.

Şimdi bütçeleyin, sonra gerçek trafiği ölçün

Mevcut trafiğinizdeki giriş, önbellekli giriş, çıkış ve düşünme belirteçlerini iki oranla hesaplayın:

Giriş dönemi: $2 giriş / $0,10 önbellekli giriş / $10 çıkış
Standart:     $4 giriş / $0,20 önbellekli giriş / $20 çıkış
Enter fullscreen mode Exit fullscreen mode

Ardından ölçümü şimdiden kurun:

  1. Apidog'u indirin.
  2. İsteğinizi gemini-3.8-flash ile kaydedin.
  3. Model adını GEMINI_MODEL değişkeninden okuyun.
  4. usageMetadata alanlarından çağrı maliyetini hesaplayın.
  5. Çağrı başına maliyet için başarısız olan bir bütçe eşiği ekleyin.
  6. Google Argon model kimliğini yayımladığında yalnızca ortam değişkenini değiştirin.

Top comments (0)