Claude Haiku 5.5, 100K jetona kadar olan istemlerde milyon giriş jetonu başına 0,10 $ ve milyon çıkış jetonu başına 0,50 $ maliyetle çalışır. 100.000 jetonu aşan istemlerde daha yüksek fiyatlar uygulanır: giriş için 0,50 $, çıkış için 2,50 $. Önbellek okumaları 0,01 $’dan başlar; Toplu İş API’si tüm oranları yarıya indirir. Anthropic, modelin Haiku 4.5’e kıyasla ortalama olarak “yaklaşık %75 daha düşük maliyetle çalıştığını” belirtir.
Bu kılavuzda fiyat kalemlerini, “%75 daha az” ifadesinin arkasındaki hesabı, 100K eşiğini aşan bir örneği, efor seviyelerinin maliyete etkisini ve Haiku 5.5’in Haiku 4.5, GPT-6 Luna ve Sonnet 5.5 ile fiyat karşılaştırmasını ele alacağız. Modele yeni başlıyorsanız önce Claude Haiku 5.5 nedir rehberini okuyun. Kendi trafiğinizdeki maliyeti doğrulamak için Apidog üzerinden istek gönderin ve yanıttaki usage bloğunu inceleyin.
Claude Haiku 5.5 API fiyatlandırma tablosu
Aşağıdaki değerler, milyon jeton başına fiyatlardır (MTok) ve Anthropic fiyatlandırma belgelerinden alınmıştır.
| Kalem | 100K jetona kadar istemler | 100K jeton üzeri istemler |
|---|---|---|
| Giriş | 0,10 $ | 0,50 $ |
| Çıkış | 0,50 $ | 2,50 $ |
| 5 dakikalık önbellek yazma | 0,125 $ | 0,625 $ |
| 1 saatlik önbellek yazma | 0,20 $ | 1,00 $ |
| Önbellek okuma — isabetler ve yenilemeler | 0,01 $ | 0,05 $ |
| Toplu giriş | 0,05 $ | 0,25 $ |
| Toplu çıkış | 0,25 $ | 1,25 $ |
Belgelerde açıkça şu kural belirtilir: 100.000 jetonu aşan bir istem, daha yüksek oranlardan ücretlendirilir.
Claude 4.6’dan itibaren diğer Claude modelleri, tam 1M bağlam penceresini tek bir oranla ücretlendirir. Haiku 5.5 bu konuda istisnadır.
Uygulamada ayrıca şunlara dikkat edin:
-
Yalnızca ABD çıkarımı:
inference_geoile yalnızca ABD’ye yönlendirme, Claude API ve AWS üzerindeki Claude Platformu’nda her jeton kategorisini 1,1 kat daha pahalı yapar. Örneğin 100K altında giriş 0,11 $, çıkış 0,55 $ olur. - Yeni jetonlayıcı: Aynı metin, Haiku 4.5’e kıyasla yaklaşık %30 daha fazla jeton üretebilir.
- Daha küçük araç yükü: Araç kullanımı sistem istemi 286 jetondur. Haiku 4.5’te bu değer 496 jetondu.
- Öncelik Katmanı ve hızlı mod yoktur.
“%75 daha az” ifadesi nereden geliyor?
Haiku 5.5’in fiyatı, 100.000 jetona kadar Haiku 4.5’e göre %90; 100.000 jetonun üzerindeyse %50 daha düşüktür. Anthropic’e göre Haiku 4.5 isteklerinin %90’ı 100K sınırının altında kalıyordu. Bu hesap yeni jetonlayıcıyı da içerir.
Yaklaşık hesap şu şekilde yapılabilir:
- İstek sayısına göre ağırlıklandırma:
0,9 × %90 + 0,1 × %50 = %86 daha düşük maliyet
- Yeni jetonlayıcının yaklaşık %30 daha fazla jeton ürettiğini ekleyin:
Kalan maliyet: %14 × 1,3 = %18,2
Tasarruf: yaklaşık %82
Anthropic’in açıkladığı ortalama ise %75’tir. Şirket ağırlıklandırma yöntemini yayımlamıyor; ayrıca uzun istemler, istek sayısına göre hesaplandığında olduğundan daha büyük bir harcama payına sahip olabilir.
Bu nedenle %75’i genel bir ortalama olarak değerlendirin. Gerçek maliyetiniz için kendi usage verinizi ölçün.
Her efor seviyesinde deneme başına maliyet
Haiku 5.5, efor seviyelerini destekleyen ilk Haiku modelidir. Seviyeler düşük ile maksimum arasındadır; API varsayılanı orta seviyedir.
Efor seviyesi, çoğu iş yükünde toplam maliyeti tarife kartından daha fazla etkileyebilir. Aşağıdaki rakamlar lansman gönderisindeki efor bazlı tablolardan alınmıştır. Anthropic, OSWorld ve Terminal-Bench’i; Artificial Analysis ise GDPval-AA’yı çalıştırmıştır.
| Efor | OSWorld 2.1 — puan / $/deneme | GDPval-AA v2.1 — Elo / $/görev | Terminal-Bench 4.0 — puan / $/deneme |
|---|---|---|---|
| düşük | %42,0 / 0,0695 $ | 1125 / 0,0117 $ | %12,7 / 0,4240 $ |
| orta | %53,3 / 0,1257 $ | 1277 / 0,0304 $ | %20,3 / 0,6798 $ |
| yüksek | %61,3 / 0,1827 $ | 1420 / 0,0894 $ | %24,8 / 1,0372 $ |
| çok yüksek | %67,6 / 0,2792 $ | 1513 / 0,2673 $ | %31,5 / 1,7545 $ |
| maksimum | %72,4 / 0,6111 $ | 1620 / 0,8659 $ | %39,2 / 2,6433 $ |
Bu tabloyu kullanırken şu noktaları göz önünde bulundurun:
- Maksimum efor, OSWorld’de orta seviyenin yaklaşık 4,9 katı maliyetlidir:
0,6111 $ ÷ 0,1257 $ = 4,9
- GDPval-AA’da maksimum efor, orta seviyenin yaklaşık 28,5 katı maliyetlidir:
0,86593 $ ÷ 0,03042 $ = 28,5
- Lansman tablosundaki en yüksek puanlar
maksimumeforla elde edilmiştir. Örneğin GDPval-AA’da API varsayılanı olanortaseviyede skor 1620 değil, 1277’dir. - Ajan tabanlı kodlama işlerinde Sonnet’i de test edin. Terminal-Bench’te Sonnet 5.5,
düşükeforda ve 0,10 $ önbellek okumalarıyla 0,6205 $ maliyet karşılığında %20 puan aldı. Haiku 5.5 iseortaeforda 0,6798 $ karşılığında %20,3 puan aldı. - Anthropic, Sonnet ve Opus’un karmaşık ajan tabanlı kodlama görevleri için daha iyi seçenekler olmaya devam ettiğini belirtir. Satır bazında sonuçlar için karşılaştırma detaylarımıza bakın.
Haiku 5.5 fiyat açısından nasıl karşılaştırılır?
| Model | Giriş / çıkış — MTok başına | Önbellek okuma | 5 dakikalık önbellek yazma | Uzun istem kuralı |
|---|---|---|---|---|
| Claude Haiku 5.5 | 100K’ya kadar 0,10 $ / 0,50 $ | 0,01 $ | 0,125 $ | 100K üzeri: 0,50 $ / 2,50 $ |
| GPT-6 Luna | 0,10 $ / 0,50 $ | 0,01 $ | 0,125 $ | 272K giriş üzeri: 2× giriş ve önbellek, 1,5× çıkış — 0,20 $ / 0,75 $ |
| Claude Haiku 4.5 | 1 $ / 5 $ | 0,10 $ | 1,25 $ | Tek oran, 200K bağlam |
| Claude Sonnet 5.5 | 2 $ / 10 $ | 0,10 $ | 2,50 $ | 1M boyunca tek oran |
GPT-6 Luna
GPT-6 Luna, 100K’ya kadar Haiku 5.5 ile aynı giriş ve çıkış fiyatını sunar. Ancak uzun istem eşiği farklıdır.
OpenAI model sayfasına göre Luna’da ek ücret 272K üzerinde başlar ve tüm istek için uygulanır.
Örneğin 150.000 giriş ve 2.000 çıkış jetonundan oluşan bir çağrıda Luna temel oranında kalır:
(150.000 × 0,10 $ + 2.000 × 0,50 $) ÷ 1.000.000 = 0,016 $
Aynı çağrı Haiku 5.5’te 100K eşiğini geçtiği için 0,08 $ olur.
Jetonlayıcılar farklı olduğundan yalnızca ham jeton sayılarıyla karar vermeyin. Bir Hacker News yorumcusu, 100K Claude jetonunun yaklaşık 60–65K GPT jetonuna karşılık geldiğini tahmin etti.
Anthropic’in OSWorld grafiğinde Haiku 5.5, orta eforda %53,3 puan ve 0,1257 $ maliyetle; Luna’yı maksimum eforda %48,9 puan ve 0,205 $ maliyetle geçti. Daha ayrıntılı analiz için Claude Haiku 5.5 vs GPT-6 Luna karşılaştırmasına bakın.
Sonnet 5.5
Sonnet 5.5, önbellek okuma fiyatını aynı gün 0,20 $’dan 0,10 $’a düşürdü. Anthropic’e göre bu indirim, çoğu ajan tabanlı işte modeli yaklaşık %20 daha ucuz hale getiriyor.
Sonnet 5.5 fiyatlandırma kılavuzumuz bu indirimden önce yazılmıştır.
Haiku 4.5
Haiku 4.5 kullanımdan kaldırılmadı. Geçiş planı yapıyorsanız, önce Haiku 5.5 vs Haiku 4.5 rehberindeki bozan değişiklikleri kontrol edin.
API kredileri ve tüketici planları
Max ve Team API kredileri
- Max 5x: ayda 100 $ Claude Platform kredisi
- Max 20x: ayda 200 $ Claude Platform kredisi
- Team Standard: koltuk başına 20 $
- Team Premium: koltuk başına 100 $
Team kredileri bir havuzda toplanır ve toplam 500 $ ile sınırlandırılır. Ücretsiz, Pro ve Kurumsal planlar uygun değildir.
API kredileri belgelerine göre bu krediler Claude API’yi kapsar; Claude Code veya bulut sağlayıcılarını kapsamaz. Ayrıca sonraki aya devretmez.
100K altı giriş fiyatı olan 0,10 $/MTok oranında, 100 $ kredi şuna karşılık gelir:
1 milyar giriş jetonu
Bu tutar yaklaşık 220.000 Örnek 1 isteğine eşittir:
100 $ ÷ 0,000455 $ = yaklaşık 220.000 istek
Tüketici planları
claude.com/pricing sayfasına göre Ücretsiz, Pro, Max, Team ve Kurumsal kullanıcılar; web, iOS ve Android üzerinde Claude.ai aracılığıyla Haiku 5.5’i seçebilir.
- Ücretsiz: 0 $
- Pro: yıllık faturalandırmada ayda 17 $, aylık faturalandırmada 20 $
- Max: ayda 100 $’dan başlar
Ücretsiz sürüm Claude Code içermez. Ayrıca sohbet planı, bir betiği veya CI işini çalıştırmak için kullanılmaz. Ayrıntılar için Claude Haiku 5.5’i ücretsiz kullanma rehberine bakın.
Bulut sağlayıcıları
Bedrock, Google Cloud ve Foundry; Haiku 5.5’i kendi fiyatlandırma sayfaları üzerinden ücretlendirir.
Apidog’da istek başına maliyeti izleyin
Her Messages API yanıtı, çağrıyı fiyatlandırmak için gereken usage nesnesini döndürür. Bunu Apidog içinde tekrarlanabilir bir test akışına dönüştürebilirsiniz.
1. API anahtarını ortam değişkeni olarak tanımlayın
export ANTHROPIC_API_KEY="your-api-key"
2. Her efor seviyesi için aynı istemi çalıştırın
düşük, orta ve yüksek seviyelerini aynı kullanıcı mesajıyla test edin:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "Classify this support ticket: ..."
}
]
}'
3. Yanıtı fiyatlandıran bir son işlemci ekleyin
Aşağıdaki Apidog test betiği, önbellekleme kullanılmadığını varsayar ve input_tokens değerini istem uzunluğu olarak kullanır:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost =
(u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => {
pm.expect(body.stop_reason).to.not.eql("refusal");
});
4. Sonuçları karşılaştırın
Her efor seviyesi için şu alanları kaydedin:
usage.input_tokensusage.output_tokens- Hesaplanan
haiku_call_usd - Görev başarısı veya kalite metriği
stop_reason
Reddetme kontrolü önemlidir; çünkü Haiku 5.5’in güvenlik sınıflandırıcılarında sunucu tarafı yedekleme yoktur.
Uçtan uca kurulum için Claude Haiku 5.5 API’sini nasıl kullanacağınız rehberine bakın.
SSS
Claude Haiku 5.5’in milyon jeton başına maliyeti ne kadar?
100K jetona kadar olan istemlerde giriş için 0,10 $, çıkış için 0,50 $’dır. 100K üzerinde bu değerler sırasıyla 0,50 $ ve 2,50 $ olur.Haiku 5.5, Haiku 4.5’ten daha mı ucuz?
Evet. 100K’ya kadar jeton başına %90, 100K üzerinde %50 daha ucuzdur. Anthropic ortalama maliyetin yaklaşık %75 daha düşük olduğunu belirtir.Haiku 5.5, GPT-6 Luna ile aynı fiyatta mı?
100K’ya kadar evet. Bu sınırın üzerinde Haiku 5.5 fiyatı 5 kat artar; Luna ise 272K’ya kadar temel fiyatını korur. Ayrıntılar için GPT-6 Luna genel bakışımıza bakın.Max plan kredileri Claude Code’da çalışır mı?
Hayır. Krediler Claude Platform API’sini kapsar, Claude Code’u kapsamaz. Plan erişimi için Claude Code’da Claude Haiku 5.5 bölümüne bakın.
Sonraki adım: kendi iş yükünüzü fiyatlandırın
En yaygın üç istek şeklinizi seçin ve şu süreci uygulayın:
- Kaç isteğin 100K jeton eşiğini geçtiğini ölçün.
- Her isteği en az
düşükveortaefor seviyelerinde çalıştırın. - Her yanıttaki
usagedeğerlerini kaydedin. - Giriş ve çıkış jetonlarını ilgili fiyat oranıyla çarpın.
- Kalite, gecikme ve maliyeti aynı tabloda karşılaştırın.
İstekleri, ortam değişkenlerini ve maliyet betiklerini tek projede yönetmek için Apidog’u indirin.

Top comments (0)