Gemini 4 Argon, giriş dönemi boyunca 1 milyon giriş belirteci (input token) için 2 dolar, 1 milyon çıkış belirteci (output token) için 10 dolar ücretlendiriliyor. Giriş dönemi sonrasında bu fiyatlar sırasıyla 4 dolar ve 20 dolar olacak. Önbelleğe alınmış girişler (cached input), giriş fiyatından %95 indirimli: giriş döneminde 1 milyon belirteç başına 0,10 dolar, sonrasında 0,20 dolar. Google, giriş döneminin bitiş tarihini açıklamadı. Argon henüz genel kullanıma açık değil; şu anda yalnızca Fairwind Programı siber savunucularına sunuluyor.
Bu yazı, Argon fiyat listesini uygulanabilir bütçe hesaplarına dönüştürür: mevcut modellerle karşılaştırma, dört maliyet senaryosu, görev başına maliyet farkları ve şimdiden kurabileceğiniz maliyet kontrolleri. Model hakkında genel bilgi için Gemini 4 Argon nedir, erişim durumu için Gemini 4 Argon ücretsiz mi yazılarına bakın. Bugün çağırabildiğiniz bir model üzerinde Apidog ile maliyet kontrollerinizi oluşturup Argon yayınlandığında yalnızca model değişkenini değiştirebilirsiniz.
Fiyat listesi
Google, oranları Gemini 4 Argon tanıtım gönderisinde yayımladı. Dipnotta, giriş dönemi sonrasında 1 milyon giriş belirteci için 4 dolar ve 1 milyon çıkış belirteci için 20 dolar uygulanacağı belirtiliyor.
| Gemini 4 Argon — 1 milyon belirteç başına | Giriş dönemi | Standart (giriş sonrası) |
|---|---|---|
| Giriş | $2,00 | $4,00 |
| Önbelleğe alınmış giriş | $0,10 | $0,20 |
| Çıkış | $10,00 | $20,00 |
| Yanıt başına maksimum çıkış (Google) | 1 milyon | 1 milyon |
| Tam 1 milyon belirteçlik çıkış maliyeti | $10,00 | $20,00 |
Önbelleğe alınmış giriş fiyatı, Google'ın belirttiği %95 indirimden türetilir:
Giriş dönemi: $2,00 × 0,05 = $0,10 / 1 milyon belirteç
Standart: $4,00 × 0,05 = $0,20 / 1 milyon belirteç
Google henüz giriş bağlam penceresini veya model kimliğini yayımlamadı. Çıkış sınırını önceki 64K sınırından artırarak 1 milyon belirteç olarak açıklıyor. Ancak üçüncü taraf bir değerlendirici olan Vals AI, test ettiği yapılandırma için 262K maksimum çıkış listeliyor.
Argon ve mevcut modellerin fiyat karşılaştırması
Tüm fiyatlar 1 milyon belirteç başınadır.
| Model | Giriş | Önbelleğe alınmış giriş | Çıkış | Maks. çıkış |
|---|---|---|---|---|
| Gemini 4 Argon (giriş) | $2 | $0,10 | $10 | 1 milyon |
| Gemini 4 Argon (standart) | $4 | $0,20 | $20 | 1 milyon |
| GPT-6 Astra | $10 | $1 | $50 | 128.000 |
| Claude Opus 5.5 | $4 | $0,20 | $20 | 128K (Batch'te 300K, beta) |
| Claude Sonnet 5.5 | $2 | $0,20 | $10 | 128K (Batch'te 300K, beta) |
| GPT-6.1 Sol | $2 | $0,10 | $10 | 128.000 |
| Claude Fable 5.1 | $10 | $0,25 | $50 | 128K |
| gemini-3.1-pro-preview (istem <=200K / >200K) | $2 / $4 | $0,20 / $0,40 | $12 / $18 | 65.536 |
| gemini-3.8-flash (giriş / 2027-01-01'den itibaren) | $0,75 / $1,50 | $0,075 / $0,15 | $3,75 / $7,50 | 65.536 |
Rakip fiyatları için satıcı belgelerini kullanın:
Pratik karşılaştırma:
-
Standart Argon, Claude Opus 5.5 ile aynı fiyatta:
$4giriş,$0,20önbellekli giriş ve$20çıkış. - Giriş dönemi Argon, Claude Sonnet 5.5 ve GPT-6.1 Sol ile aynı
$2/$10oranında. - GPT-6 Astra ve Claude Fable 5.1, giriş dönemi Argon'dan 5 kat; standart Argon'dan 2,5 kat pahalıdır. Ayrıntı için Claude Fable 5.1 fiyatlandırması yazısına bakın.
-
Argon'un giriş dönemi çıkış fiyatı (
$10),gemini-3.1-pro-previewçıkış fiyatının ($12) altındadır. - Uzun istemler fiyatı değiştirebilir. OpenAI, 272K giriş belirtecini aşan isteklerde tüm çağrı için giriş ve önbellek oranlarını 2 kat, çıkış oranını 1,5 kat uygular. Gemini 3.1 Pro, 200K üzeri istemlerde daha yüksek oran kullanır. Anthropic'te bu tür bir kademe yoktur. Google, Argon için uzun istem kademesi açıklamadı.
Yetenek karşılaştırması için Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5 yazısına bakın.
Düşünme belirteçlerini çıkış maliyetine dahil edin
Mevcut Gemini modellerinde düşünme belirteçleri çıkış olarak faturalandırılır. Google'ın düşünme belgeleri, yanıt fiyatlandırmasının çıktı ve düşünme belirteçlerinin toplamı olduğunu belirtir.
Google, Argon için bunu ayrıca belgelemedi. Ancak bütçe oluştururken şu varsayımı kullanın:
faturalandırılan_çıkış = yanıt_belirteçleri + düşünme_belirteçleri
Google, Argon değerlendirmelerini “en yüksek düşünme ayarlarıyla” çalıştırdığını belirtti. Bu nedenle $10 / 1 milyon çıkış belirteci ifadesini yalnızca görünür yanıt değil, yanıt ve muhakeme toplamı olarak değerlendirin.
Dört maliyet senaryosu
Temel formül:
maliyet = (giriş_belirteçleri / 1.000.000 × giriş_oranı)
+ (çıkış_belirteçleri / 1.000.000 × çıkış_oranı)
İlk üç senaryo önbelleğe alma kullanılmadığını varsayar.
1. Tipik API çağrısı: 20K giriş, 5K çıkış
Giriş dönemi:
20.000 / 1.000.000 × $2 = $0,04 giriş
5.000 / 1.000.000 × $10 = $0,05 çıkış
Toplam = $0,09
Standart fiyat:
20.000 / 1.000.000 × $4 = $0,08 giriş
5.000 / 1.000.000 × $20 = $0,10 çıkış
Toplam = $0,18
Günde 1.000 çağrı için:
| Fiyat dönemi | Günlük maliyet |
|---|---|
| Giriş dönemi | $90 |
| Standart | $180 |
Aynı çağrının karşılaştırmalı maliyetleri:
| Model | Tahmini çağrı maliyeti |
|---|---|
| Gemini 4 Argon — giriş dönemi | $0,09 |
| Gemini 4 Argon — standart | $0,18 |
| Claude Opus 5.5 | $0,18 |
| GPT-6 Astra | $0,45 |
| gemini-3.1-pro-preview | $0,10 |
| gemini-3.8-flash — giriş fiyatı | Yaklaşık $0,034 |
2. Uzun aracı dönüşü: 200K giriş, 50K çıkış
Araç çağrıları, belge bağlamı ve önceki mesajlar uzun istem maliyetini hızla büyütebilir.
Giriş dönemi:
200.000 / 1.000.000 × $2 = $0,40 giriş
50.000 / 1.000.000 × $10 = $0,50 çıkış
Toplam = $0,90
Standart fiyat:
200.000 / 1.000.000 × $4 = $0,80 giriş
50.000 / 1.000.000 × $20 = $1,00 çıkış
Toplam = $1,80
Karşılaştırma:
- GPT-6 Astra:
$4,50($2,00 + $2,50) -
gemini-3.1-pro-preview:$1,00($0,40 + $0,60)
Ancak 200K, Gemini 3.1 Pro'nun kademe sınırıdır. Daha uzun istemlerde $4/$18 oranı uygulanır. Argon benzer bir kademe kullanırsa, uzun bağlamlı aracı iş akışları daha pahalı olabilir.
3. Tek maksimum yanıt: 1 milyon çıkış belirteci
Giriş maliyeti hariç yalnızca çıkış:
| Fiyat dönemi | 1 milyon çıkış maliyeti |
|---|---|
| Giriş dönemi | $10,00 |
| Standart | $20,00 |
Çağrıya 100K belirteçlik istem eklenirse:
| Fiyat dönemi | Giriş | Çıkış | Toplam |
|---|---|---|---|
| Giriş dönemi | $0,20 | $10,00 | $10,20 |
| Standart | $0,40 | $20,00 | $20,40 |
Tablodaki diğer modeller tek bir senkronize yanıtta bu çıkış boyutuna ulaşamaz: çoğu 128K, önceki Gemini Pro ise 65.536 belirteç ile sınırlıdır.
Vals AI'ın listelediği 262K maksimum çıkış için tam yanıt maliyeti:
Giriş dönemi: 262.000 / 1.000.000 × $10 = $2,62
Standart: 262.000 / 1.000.000 × $20 = $5,24
Zaman aşımı, akış ve ağ geçidi ayarları için Gemini 4 Argon'un 1 milyon çıkış belirteçleri yazısını inceleyin.
4. 500K belirteçlik istemi 10 kez önbellekten kullanmak
500K belirteçlik aynı kod tabanını veya sözleşme setini 10 kez gönderdiğinizi ve her çağrıda 5K çıkış aldığınızı varsayalım.
Varsayımlar:
- İlk çağrı, önbelleği oluşturmak için tam giriş fiyatını öder.
- Sonraki 9 çağrı, önbelleğe alınmış giriş oranını kullanır.
- Her çağrı 5K çıkış üretir.
| 10 çağrı, 500K istem, her biri 5K çıkış | Giriş dönemi | Standart |
|---|---|---|
Giriş, önbelleğe alma yok (10 × 500K) |
$10,00 | $20,00 |
Giriş, önbelleğe alınmış (1 tam + 9 önbellekli) |
$1,00 + 9 × $0,05 = $1,45 |
$2,00 + 9 × $0,10 = $2,90 |
Çıkış (10 × 5K) |
$0,50 | $1,00 |
| Önbelleğe alma ile toplam | $1,95 | $3,90 |
| Önbelleğe alma olmadan toplam | $10,50 | $21,00 |
Bu örnekte önbelleğe alma, giriş maliyetini %85,5 azaltır.
Dikkat edilmesi gerekenler:
- Google, Argon için önbellek depolama ücreti açıklamadı.
-
gemini-3.1-pro-preview, önbellek depolama için saatte 1 milyon belirteç başına$4,50ücret alır. Bu oranla 500K belirteci bir saat tutmak$2,25ek maliyet oluşturur. - 500K istem, Gemini 3.1 Pro'nun 200K sınırını aşar.
- Argon'un standart önbellek oranı, Claude Opus 5.5 ile aynı:
$0,20. Bu nedenle Claude Opus 5.5 istem önbellekleme maliyet matematiği içindeki başa baş yaklaşımını kullanabilirsiniz.
Belirteç başına fiyat, görev başına maliyet değildir
Düşük token fiyatı, her zaman düşük görev maliyeti anlamına gelmez. Asıl değişken, modelin görev başına tükettiği giriş, çıkış ve düşünme belirteçleridir.
Artificial Analysis, Gemini 4 Argon (Yüksek) için Intelligent Index çalıştırmasında giriş fiyatıyla görev başına $1,99 listeliyor. The Decoder aynı çalıştırmayı standart fiyatlarla görev başına $3,98 olarak belirtiyor.
Artificial Analysis verilerinde:
- Argon (Yüksek): görev başına yaklaşık
62Kçıkış belirteci - GPT-6 Astra (maksimum): görev başına yaklaşık
27Kçıkış belirteci
Yalnızca çıkış maliyeti üzerinden:
Argon giriş dönemi:
62.000 / 1.000.000 × $10 = $0,62
GPT-6 Astra:
27.000 / 1.000.000 × $50 = $1,35
Argon'un standart oranları Astra'dan %60 düşük olsa da, daha fazla belirteç üretmesi toplam görev maliyetini değiştirebilir.
Vals AI da benzer bir fark gösteriyor:
| Model | Vals Index test başına maliyet |
|---|---|
| Gemini 4 Argon | $15,68 |
| Claude Opus 5.5 | $32,14 |
| Claude Sonnet 5.5 | $21,34 |
| GPT-6.1 Sol | $3,24 |
Claude Sonnet 5.5 ve GPT-6.1 Sol, Argon'un giriş dönemi fiyatına yakın görünse de test başına maliyetleri 6 kattan fazla farklılık gösterebilir.
Sonuç: Bütçeyi yalnızca fiyat listesinden değil, kendi üretim trafiğinizin token telemetrilerinden oluşturun.
Argon yayınlanmadan önce maliyet kontrolleri kurun
1. Çıkış üst sınırı belirleyin
generateContent kullanıyorsanız generationConfig.maxOutputTokens ile bir üst sınır uygulayın.
{
"generationConfig": {
"maxOutputTokens": 8000
}
}
Google, yeni modellerin Interactions API'de yayınlandığını belirtiyor. Argon için belgelenen eşdeğer alanı kullanın.
Bu kontrol önemlidir çünkü 1 milyonluk teorik üst sınır, standart fiyatla çağrı başına yalnızca çıkış için $20 demektir.
2. Sabit bağlamı önbelleğe alın
Önbelleğe alma için iyi adaylar:
- Sistem talimatları
- Araç şemaları
- API sözleşmeleri
- Tekrarlanan teknik belgeler
- Büyük kod tabanı bağlamı
- Her çağrıda yeniden gönderilen referans verileri
Her çağrıda değişen kullanıcı girdisini önbelleğe alınmış sabit içerikten ayırın. Böylece %95 giriş indirimi, tekrar eden iş yüklerinde doğrudan maliyet avantajı sağlar.
3. Düşünme seviyesini ölçerek seçin
Google henüz Argon'un düşünme seviyelerini açıklamadı. Mevcut modellerde:
-
gemini-3.1-pro-preview: varsayılanyüksek -
gemini-3.8-flash: varsayılanorta
Argon seçenekleri yayımlandığında aynı görev setini farklı düşünme seviyelerinde çalıştırın. Kalite korunuyorsa daha düşük seviye, çıkış ve düşünme belirteci maliyetini azaltabilir.
4. usageMetadata üzerinden maliyet iddiası ekleyin
Her generateContent yanıtındaki usageMetadata alanını kaydedin. Modeli ortam değişkeniyle yönetin:
GEMINI_MODEL=gemini-3.8-flash
Argon yayınlandığında yalnızca bu değeri güncelleyin:
GEMINI_MODEL=gemini-4-argon
Maliyet hesabı:
maliyet = önbelleğe_alınmamış_giriş / 1.000.000 × giriş_oranı
+ önbelleğe_alınmış_giriş / 1.000.000 × önbellek_oranı
+ (çıkış + düşünme) / 1.000.000 × çıkış_oranı
Örnek JavaScript maliyet hesaplayıcısı:
const pricing = {
launch: {
input: 2,
cachedInput: 0.10,
output: 10
},
standard: {
input: 4,
cachedInput: 0.20,
output: 20
}
};
function calculateCost(usageMetadata, phase = "launch") {
const rates = pricing[phase];
const inputTokens = usageMetadata.promptTokenCount ?? 0;
const cachedTokens = usageMetadata.cachedContentTokenCount ?? 0;
const outputTokens = usageMetadata.candidatesTokenCount ?? 0;
const thoughtsTokens = usageMetadata.thoughtsTokenCount ?? 0;
const uncachedInputTokens = Math.max(inputTokens - cachedTokens, 0);
return (
(uncachedInputTokens / 1_000_000) * rates.input +
(cachedTokens / 1_000_000) * rates.cachedInput +
((outputTokens + thoughtsTokens) / 1_000_000) * rates.output
);
}
Ardından bütçe sınırı koyun:
const cost = calculateCost(response.usageMetadata, "launch");
const maxCostPerRequest = 0.25;
if (cost > maxCostPerRequest) {
throw new Error(
`Çağrı maliyeti bütçeyi aştı: $${cost.toFixed(4)} > $${maxCostPerRequest}`
);
}
Apidog içinde isteği GEMINI_MODEL ortam değişkeniyle kaydedin, usageMetadata değerlerini maliyete dönüştüren yanıt sonrası bir iddia ekleyin ve çağrı bütçe sınırını aşarsa testi başarısız yapın. Bugün gemini-3.8-flash üzerinde çalıştırabilir, Argon model kimliği geldiğinde tek değişkenle aynı paketi yeniden kullanabilirsiniz.
Google'ın henüz açıklamadığı fiyatlandırma detayları
Aşağıdaki bilgiler henüz yayımlanmadı:
- Giriş döneminin süresi ve standart
$4/$20oranının başlayacağı tarih - 200K üzerindeki istemler için ek fiyat kademesi
- Batch veya Flex fiyatlandırması
- Önbellek depolama ücretleri
- Hız limitleri
- Ücretsiz katman olup olmayacağı
Gemini 3.1 Pro için Batch ve Flex seçenekleri bulunuyor; oranlar girişte $1/$2, çıkışta $6/$9. Ancak Argon için aynı seçeneklerin sunulacağı doğrulanmadı.
Sıkça sorulan sorular
Gemini 4 Argon'un 1 milyon belirteç başına maliyeti ne kadar?
Giriş döneminde 1 milyon giriş belirteci için $2, 1 milyon çıkış belirteci için $10. Sonrasında oranlar $4 ve $20. Önbelleğe alınmış giriş, %95 indirimli olarak sırasıyla $0,10 ve $0,20.
Giriş fiyatı ne kadar sürecek?
Google süre veya bitiş tarihi açıklamadı.
Düşünme belirteçleri çıkış olarak faturalandırılır mı?
Mevcut Gemini modellerinde evet. Google, Argon için bunu ayrıca belgelemediği için bütçe hesaplarında dahil etmek gerekir.
1 milyon belirteçlik çıkış yanıtı ne kadara mal olur?
Giriş hariç, giriş döneminde $10; standart fiyatla $20.
Argon, Claude Opus 5.5 veya GPT-6 Astra'dan daha mı ucuz?
Token başına standart Argon, Claude Opus 5.5 ile aynı fiyatta ve GPT-6 Astra'dan %60 daha düşük oranlıdır. Ancak görev başına maliyet, modelin ürettiği toplam token miktarına bağlıdır. Daha düşük maliyetli bir Gemini seçeneği için Gemini 3.8 Flash fiyatlandırması yazısına bakın.
Argon için bugün ödeme yapabilir miyim?
Hayır. Şu anda yalnızca Fairwind Programı ortaklarına sunuluyor. Ücretli API müşterileri ve Google AI Ultra aboneleri için erişim daha sonra gelecek, ancak tarih açıklanmadı.
Şimdi bütçeleyin, sonra gerçek trafiği ölçün
Mevcut trafiğinizdeki giriş, önbellekli giriş, çıkış ve düşünme belirteçlerini iki oranla hesaplayın:
Giriş dönemi: $2 giriş / $0,10 önbellekli giriş / $10 çıkış
Standart: $4 giriş / $0,20 önbellekli giriş / $20 çıkış
Ardından ölçümü şimdiden kurun:
- Apidog'u indirin.
- İsteğinizi
gemini-3.8-flashile kaydedin. - Model adını
GEMINI_MODELdeğişkeninden okuyun. -
usageMetadataalanlarından çağrı maliyetini hesaplayın. - Çağrı başına maliyet için başarısız olan bir bütçe eşiği ekleyin.
- Google Argon model kimliğini yayımladığında yalnızca ortam değişkenini değiştirin.

Top comments (0)