DEV Community

Cover image for Claude Haiku 5.5 Fiyatları
Tobias Hoffmann
Tobias Hoffmann

Posted on Originally published at apidog.com

Claude Haiku 5.5 Fiyatları

Claude Haiku 5.5, 100K jetona kadar olan istemlerde milyon giriş jetonu başına 0,10 $ ve milyon çıkış jetonu başına 0,50 $ maliyetle çalışır. 100.000 jetonu aşan istemlerde daha yüksek fiyatlar uygulanır: giriş için 0,50 $, çıkış için 2,50 $. Önbellek okumaları 0,01 $’dan başlar; Toplu İş API’si tüm oranları yarıya indirir. Anthropic, modelin Haiku 4.5’e kıyasla ortalama olarak “yaklaşık %75 daha düşük maliyetle çalıştığını” belirtir.

Apidog'u bugün deneyin

Bu kılavuzda fiyat kalemlerini, “%75 daha az” ifadesinin arkasındaki hesabı, 100K eşiğini aşan bir örneği, efor seviyelerinin maliyete etkisini ve Haiku 5.5’in Haiku 4.5, GPT-6 Luna ve Sonnet 5.5 ile fiyat karşılaştırmasını ele alacağız. Modele yeni başlıyorsanız önce Claude Haiku 5.5 nedir rehberini okuyun. Kendi trafiğinizdeki maliyeti doğrulamak için Apidog üzerinden istek gönderin ve yanıttaki usage bloğunu inceleyin.

Claude Haiku 5.5 API fiyatlandırma tablosu

Aşağıdaki değerler, milyon jeton başına fiyatlardır (MTok) ve Anthropic fiyatlandırma belgelerinden alınmıştır.

Kalem 100K jetona kadar istemler 100K jeton üzeri istemler
Giriş 0,10 $ 0,50 $
Çıkış 0,50 $ 2,50 $
5 dakikalık önbellek yazma 0,125 $ 0,625 $
1 saatlik önbellek yazma 0,20 $ 1,00 $
Önbellek okuma — isabetler ve yenilemeler 0,01 $ 0,05 $
Toplu giriş 0,05 $ 0,25 $
Toplu çıkış 0,25 $ 1,25 $

Belgelerde açıkça şu kural belirtilir: 100.000 jetonu aşan bir istem, daha yüksek oranlardan ücretlendirilir.

Claude 4.6’dan itibaren diğer Claude modelleri, tam 1M bağlam penceresini tek bir oranla ücretlendirir. Haiku 5.5 bu konuda istisnadır.

Uygulamada ayrıca şunlara dikkat edin:

  • Yalnızca ABD çıkarımı: inference_geo ile yalnızca ABD’ye yönlendirme, Claude API ve AWS üzerindeki Claude Platformu’nda her jeton kategorisini 1,1 kat daha pahalı yapar. Örneğin 100K altında giriş 0,11 $, çıkış 0,55 $ olur.
  • Yeni jetonlayıcı: Aynı metin, Haiku 4.5’e kıyasla yaklaşık %30 daha fazla jeton üretebilir.
  • Daha küçük araç yükü: Araç kullanımı sistem istemi 286 jetondur. Haiku 4.5’te bu değer 496 jetondu.
  • Öncelik Katmanı ve hızlı mod yoktur.

“%75 daha az” ifadesi nereden geliyor?

Haiku 5.5’in fiyatı, 100.000 jetona kadar Haiku 4.5’e göre %90; 100.000 jetonun üzerindeyse %50 daha düşüktür. Anthropic’e göre Haiku 4.5 isteklerinin %90’ı 100K sınırının altında kalıyordu. Bu hesap yeni jetonlayıcıyı da içerir.

Yaklaşık hesap şu şekilde yapılabilir:

  1. İstek sayısına göre ağırlıklandırma:
   0,9 × %90 + 0,1 × %50 = %86 daha düşük maliyet
Enter fullscreen mode Exit fullscreen mode
  1. Yeni jetonlayıcının yaklaşık %30 daha fazla jeton ürettiğini ekleyin:
   Kalan maliyet: %14 × 1,3 = %18,2
   Tasarruf: yaklaşık %82
Enter fullscreen mode Exit fullscreen mode

Haiku 5.5 maliyet karşılaştırması

Anthropic’in açıkladığı ortalama ise %75’tir. Şirket ağırlıklandırma yöntemini yayımlamıyor; ayrıca uzun istemler, istek sayısına göre hesaplandığında olduğundan daha büyük bir harcama payına sahip olabilir.

Bu nedenle %75’i genel bir ortalama olarak değerlendirin. Gerçek maliyetiniz için kendi usage verinizi ölçün.

Her efor seviyesinde deneme başına maliyet

Haiku 5.5, efor seviyelerini destekleyen ilk Haiku modelidir. Seviyeler düşük ile maksimum arasındadır; API varsayılanı orta seviyedir.

Efor seviyesi, çoğu iş yükünde toplam maliyeti tarife kartından daha fazla etkileyebilir. Aşağıdaki rakamlar lansman gönderisindeki efor bazlı tablolardan alınmıştır. Anthropic, OSWorld ve Terminal-Bench’i; Artificial Analysis ise GDPval-AA’yı çalıştırmıştır.

Efor OSWorld 2.1 — puan / $/deneme GDPval-AA v2.1 — Elo / $/görev Terminal-Bench 4.0 — puan / $/deneme
düşük %42,0 / 0,0695 $ 1125 / 0,0117 $ %12,7 / 0,4240 $
orta %53,3 / 0,1257 $ 1277 / 0,0304 $ %20,3 / 0,6798 $
yüksek %61,3 / 0,1827 $ 1420 / 0,0894 $ %24,8 / 1,0372 $
çok yüksek %67,6 / 0,2792 $ 1513 / 0,2673 $ %31,5 / 1,7545 $
maksimum %72,4 / 0,6111 $ 1620 / 0,8659 $ %39,2 / 2,6433 $

Bu tabloyu kullanırken şu noktaları göz önünde bulundurun:

  • Maksimum efor, OSWorld’de orta seviyenin yaklaşık 4,9 katı maliyetlidir:
  0,6111 $ ÷ 0,1257 $ = 4,9
Enter fullscreen mode Exit fullscreen mode
  • GDPval-AA’da maksimum efor, orta seviyenin yaklaşık 28,5 katı maliyetlidir:
  0,86593 $ ÷ 0,03042 $ = 28,5
Enter fullscreen mode Exit fullscreen mode
  • Lansman tablosundaki en yüksek puanlar maksimum eforla elde edilmiştir. Örneğin GDPval-AA’da API varsayılanı olan orta seviyede skor 1620 değil, 1277’dir.
  • Ajan tabanlı kodlama işlerinde Sonnet’i de test edin. Terminal-Bench’te Sonnet 5.5, düşük eforda ve 0,10 $ önbellek okumalarıyla 0,6205 $ maliyet karşılığında %20 puan aldı. Haiku 5.5 ise orta eforda 0,6798 $ karşılığında %20,3 puan aldı.
  • Anthropic, Sonnet ve Opus’un karmaşık ajan tabanlı kodlama görevleri için daha iyi seçenekler olmaya devam ettiğini belirtir. Satır bazında sonuçlar için karşılaştırma detaylarımıza bakın.

Haiku 5.5 fiyat açısından nasıl karşılaştırılır?

Model Giriş / çıkış — MTok başına Önbellek okuma 5 dakikalık önbellek yazma Uzun istem kuralı
Claude Haiku 5.5 100K’ya kadar 0,10 $ / 0,50 $ 0,01 $ 0,125 $ 100K üzeri: 0,50 $ / 2,50 $
GPT-6 Luna 0,10 $ / 0,50 $ 0,01 $ 0,125 $ 272K giriş üzeri: 2× giriş ve önbellek, 1,5× çıkış — 0,20 $ / 0,75 $
Claude Haiku 4.5 1 $ / 5 $ 0,10 $ 1,25 $ Tek oran, 200K bağlam
Claude Sonnet 5.5 2 $ / 10 $ 0,10 $ 2,50 $ 1M boyunca tek oran

GPT-6 Luna

GPT-6 Luna, 100K’ya kadar Haiku 5.5 ile aynı giriş ve çıkış fiyatını sunar. Ancak uzun istem eşiği farklıdır.

OpenAI model sayfasına göre Luna’da ek ücret 272K üzerinde başlar ve tüm istek için uygulanır.

Örneğin 150.000 giriş ve 2.000 çıkış jetonundan oluşan bir çağrıda Luna temel oranında kalır:

(150.000 × 0,10 $ + 2.000 × 0,50 $) ÷ 1.000.000 = 0,016 $
Enter fullscreen mode Exit fullscreen mode

Aynı çağrı Haiku 5.5’te 100K eşiğini geçtiği için 0,08 $ olur.

Jetonlayıcılar farklı olduğundan yalnızca ham jeton sayılarıyla karar vermeyin. Bir Hacker News yorumcusu, 100K Claude jetonunun yaklaşık 60–65K GPT jetonuna karşılık geldiğini tahmin etti.

Anthropic’in OSWorld grafiğinde Haiku 5.5, orta eforda %53,3 puan ve 0,1257 $ maliyetle; Luna’yı maksimum eforda %48,9 puan ve 0,205 $ maliyetle geçti. Daha ayrıntılı analiz için Claude Haiku 5.5 vs GPT-6 Luna karşılaştırmasına bakın.

Sonnet 5.5

Sonnet 5.5, önbellek okuma fiyatını aynı gün 0,20 $’dan 0,10 $’a düşürdü. Anthropic’e göre bu indirim, çoğu ajan tabanlı işte modeli yaklaşık %20 daha ucuz hale getiriyor.

Sonnet 5.5 fiyatlandırma kılavuzumuz bu indirimden önce yazılmıştır.

Haiku 4.5

Haiku 4.5 kullanımdan kaldırılmadı. Geçiş planı yapıyorsanız, önce Haiku 5.5 vs Haiku 4.5 rehberindeki bozan değişiklikleri kontrol edin.

API kredileri ve tüketici planları

Max ve Team API kredileri

  • Max 5x: ayda 100 $ Claude Platform kredisi
  • Max 20x: ayda 200 $ Claude Platform kredisi
  • Team Standard: koltuk başına 20 $
  • Team Premium: koltuk başına 100 $

Team kredileri bir havuzda toplanır ve toplam 500 $ ile sınırlandırılır. Ücretsiz, Pro ve Kurumsal planlar uygun değildir.

API kredileri belgelerine göre bu krediler Claude API’yi kapsar; Claude Code veya bulut sağlayıcılarını kapsamaz. Ayrıca sonraki aya devretmez.

100K altı giriş fiyatı olan 0,10 $/MTok oranında, 100 $ kredi şuna karşılık gelir:

1 milyar giriş jetonu
Enter fullscreen mode Exit fullscreen mode

Bu tutar yaklaşık 220.000 Örnek 1 isteğine eşittir:

100 $ ÷ 0,000455 $ = yaklaşık 220.000 istek
Enter fullscreen mode Exit fullscreen mode

Tüketici planları

claude.com/pricing sayfasına göre Ücretsiz, Pro, Max, Team ve Kurumsal kullanıcılar; web, iOS ve Android üzerinde Claude.ai aracılığıyla Haiku 5.5’i seçebilir.

  • Ücretsiz: 0 $
  • Pro: yıllık faturalandırmada ayda 17 $, aylık faturalandırmada 20 $
  • Max: ayda 100 $’dan başlar

Ücretsiz sürüm Claude Code içermez. Ayrıca sohbet planı, bir betiği veya CI işini çalıştırmak için kullanılmaz. Ayrıntılar için Claude Haiku 5.5’i ücretsiz kullanma rehberine bakın.

Bulut sağlayıcıları

Bedrock, Google Cloud ve Foundry; Haiku 5.5’i kendi fiyatlandırma sayfaları üzerinden ücretlendirir.

Apidog’da istek başına maliyeti izleyin

Her Messages API yanıtı, çağrıyı fiyatlandırmak için gereken usage nesnesini döndürür. Bunu Apidog içinde tekrarlanabilir bir test akışına dönüştürebilirsiniz.

1. API anahtarını ortam değişkeni olarak tanımlayın

export ANTHROPIC_API_KEY="your-api-key"
Enter fullscreen mode Exit fullscreen mode

2. Her efor seviyesi için aynı istemi çalıştırın

düşük, orta ve yüksek seviyelerini aynı kullanıcı mesajıyla test edin:

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket: ..."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

3. Yanıtı fiyatlandıran bir son işlemci ekleyin

Aşağıdaki Apidog test betiği, önbellekleme kullanılmadığını varsayar ve input_tokens değerini istem uzunluğu olarak kullanır:

const body = pm.response.json();
const u = body.usage;

const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;

const cost =
  (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;

pm.environment.set("haiku_call_usd", cost.toFixed(6));

pm.test("not a refusal", () => {
  pm.expect(body.stop_reason).to.not.eql("refusal");
});
Enter fullscreen mode Exit fullscreen mode

4. Sonuçları karşılaştırın

Her efor seviyesi için şu alanları kaydedin:

  • usage.input_tokens
  • usage.output_tokens
  • Hesaplanan haiku_call_usd
  • Görev başarısı veya kalite metriği
  • stop_reason

Reddetme kontrolü önemlidir; çünkü Haiku 5.5’in güvenlik sınıflandırıcılarında sunucu tarafı yedekleme yoktur.

Uçtan uca kurulum için Claude Haiku 5.5 API’sini nasıl kullanacağınız rehberine bakın.

SSS

  • Claude Haiku 5.5’in milyon jeton başına maliyeti ne kadar?

    100K jetona kadar olan istemlerde giriş için 0,10 $, çıkış için 0,50 $’dır. 100K üzerinde bu değerler sırasıyla 0,50 $ ve 2,50 $ olur.

  • Haiku 5.5, Haiku 4.5’ten daha mı ucuz?

    Evet. 100K’ya kadar jeton başına %90, 100K üzerinde %50 daha ucuzdur. Anthropic ortalama maliyetin yaklaşık %75 daha düşük olduğunu belirtir.

  • Haiku 5.5, GPT-6 Luna ile aynı fiyatta mı?

    100K’ya kadar evet. Bu sınırın üzerinde Haiku 5.5 fiyatı 5 kat artar; Luna ise 272K’ya kadar temel fiyatını korur. Ayrıntılar için GPT-6 Luna genel bakışımıza bakın.

  • Max plan kredileri Claude Code’da çalışır mı?

    Hayır. Krediler Claude Platform API’sini kapsar, Claude Code’u kapsamaz. Plan erişimi için Claude Code’da Claude Haiku 5.5 bölümüne bakın.

Sonraki adım: kendi iş yükünüzü fiyatlandırın

En yaygın üç istek şeklinizi seçin ve şu süreci uygulayın:

  1. Kaç isteğin 100K jeton eşiğini geçtiğini ölçün.
  2. Her isteği en az düşük ve orta efor seviyelerinde çalıştırın.
  3. Her yanıttaki usage değerlerini kaydedin.
  4. Giriş ve çıkış jetonlarını ilgili fiyat oranıyla çarpın.
  5. Kalite, gecikme ve maliyeti aynı tabloda karşılaştırın.

İstekleri, ortam değişkenlerini ve maliyet betiklerini tek projede yönetmek için Apidog’u indirin.

Top comments (0)