DEV Community

Cover image for Claude Opus 5 Efor Parametresi: Maliyet-Yetenek Değişimi
Tobias Hoffmann
Tobias Hoffmann

Posted on • Originally published at apidog.com

Claude Opus 5 Efor Parametresi: Maliyet-Yetenek Değişimi

24 Temmuz 2026'daki Claude Opus 5 lansmanında ana akım yazıların çoğu aynı özellikten bahsetti: maliyet ve yetenek arasında geçiş yapma imkânı. Ancak bu geçişin API'de hangi parametreyle yapıldığı, seviyelerin ne anlama geldiği, maliyet ve gecikmeyi nasıl etkilediği çoğunlukla açıklanmadı.

Apidog'u bugün deneyin

Bu özellik, effort adlı bir istek parametresidir. Opus 5'te beş seviyesi vardır ve varsayılan değer high'dır. Anthropic, Opus 5 için seviyeleri yeniden kalibre etti. Bu nedenle Opus 4.8'den taşıdığınız effort ayarları doğrudan doğruya geçerli kabul edilmemelidir. Ayrıca belirli bir thinking ve effort kombinasyonu 400 hatası döndürür.

💡 Seviyeleri gerçek bir uç noktada karşılaştırmak için aynı isteği beş farklı effort ayarıyla gönderin; dönen yanıtları, usage değerlerini ve gecikmeleri yan yana inceleyin. Bunu Apidog ile koleksiyon halinde yönetebilirsiniz.

Effort parametresi nedir?

effort, Mesajlar API isteğindeki output_config nesnesinde yer alır:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": { "effort": "high" },
  "messages": [
    {
      "role": "user",
      "content": "Refactor this module and explain the tradeoffs."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Bu parametre, modelin görünür yanıtı üretmeden önce ne kadar dahili muhakeme bütçesi kullanacağını kontrol eder.

  • Daha yüksek effort: daha fazla muhakeme jetonu, maliyet ve gecikme
  • Daha düşük effort: daha az muhakeme jetonu, maliyet ve gecikme

Tüketici arayüzlerinde bu genellikle bir effort seçici olarak görünür. API tarafında ise doğrudan kontrol ettiğiniz alan output_config.effort değeridir.

İsteğin tamamı için Opus 5 API kılavuzuna, parametre referansı için Anthropic'in modeller genel bakışına bakın.

Effort, çıktı uzunluğu ayarı değildir

Effort'u düşürmek, görünür yanıtı otomatik olarak kısaltmaz. Anthropic'in Opus 5 istem rehberi, effort'un görünen metin uzunluğunu değil, düşünme bütçesini azalttığını belirtir.

Daha kısa cevap istiyorsanız bunu istemde açıkça belirtin:

Yanıtı en fazla 5 maddeyle sınırla.
Kod açıklamasını 150 kelimeyi geçmeyecek şekilde yaz.
Enter fullscreen mode Exit fullscreen mode

low kullanmak, tek başına daha kısa bir yanıt garantilemez.

Beş effort seviyesi

Seviye Ne işe yarar Tipik kullanım
low Minimal muhakeme Yüksek hacimli sınıflandırma, çıkarma, yönlendirme, kısa özetler
medium Orta düzey muhakeme Geri çağrılan bağlamda Soru-Cevap, tek dosya düzenlemeleri, yapılandırılmış dönüşümler
high Varsayılan. Önemli muhakeme Henüz ölçüm yapmadığınız genel amaçlı işler
xhigh Genişletilmiş muhakeme Kodlama ve temsilci döngüleri
max Maksimum muhakeme bütçesi Hatalı cevabın token maliyetinden daha pahalı olduğu zor tek seferlik problemler

Bu tabloda iki önemli nokta vardır.

1. Varsayılan seviye high'dır

İstekte output_config göndirmezseniz Opus 5 high seviyesinde çalışır:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "messages": [
    {
      "role": "user",
      "content": "Summarize this incident report."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Bu, maliyet tahminlerinde önemlidir. Opus 5'te değişiklik yapmadığınız bir istek bile muhakeme bütçesi kullanır. Opus 4.8'de aynı türde değiştirilmemiş bir istek düşünme çalıştırmıyorsa, geçiş sonrası harcamanız beklenmedik biçimde artabilir.

Bu, Opus 4.8'den Opus 5'e geçişteki kritik değişikliklerden biridir.

2. Kodlama ve temsilci işlerinde max ile değil, xhigh ile başlayın

Anthropic, kodlama ve temsilci iş yükleri için başlangıç noktası olarak xhigh önerir. max daha yüksek bir bütçe sağlar; ancak ölçülebilir bir yarar olmadan ekstra çıktı tarafı harcaması oluşturabilir.

Pratik yaklaşım:

  1. xhigh ile bir temel ölçüm alın.
  2. Aynı görevleri high, medium ve gerekiyorsa low ile çalıştırın.
  3. Başarı kriterinizi karşılayan en düşük effort seviyesini seçin.

Yeniden kalibrasyon neyi değiştirdi?

Opus 5'teki effort seviyeleri, Opus 4.8 seviyeleriyle bire bir eşdeğer değildir.

Örneğin, Opus 5'teki medium, Opus 4.8'deki medium ile aynı miktarda muhakeme anlamına gelmez. Bu nedenle eski yapılandırmayı taşımak yerine Opus 5 üzerinde yeni bir effort değerlendirmesi çalıştırmanız gerekir.

Pratik sonuç şudur: Önceki Opus modellerinde low ve medium, ciddi üretim iş yükleri için çoğu ekipte yeterince güçlü görülmüyordu. Opus 5'te alt seviyeler daha güçlü olduğundan, low ve medium artık bazı üretim görevlerinde anlamlı seçenekler olabilir.

Bu özellikle şu tür iş yüklerinde maliyet avantajı sağlayabilir:

  • Sınıflandırma
  • Bilgi çıkarma
  • Etiketleme
  • Yönlendirme
  • Yapılandırılmış dönüşüm
  • Kısa özetleme

Opus 5, Opus 4.8 ile aynı şekilde milyon giriş tokenı başına 5 dolar ve milyon çıkış tokenı başına 25 dolar maliyetle sunulur. Muhakeme tokenları çıkış tarafında faturalandırılır. Bu nedenle doğruluk farkı yaratmayan bir sınıflandırma hattını high yerine low ile çalıştırmak, çıktı harcamasında anlamlı bir fark oluşturabilir.

Fiyatlandırma ayrıntıları, %50 toplu indirim ve 512 token önbellek minimumu için Opus 5 fiyatlandırma dökümüne bakın.

Daha geniş çaplı optimizasyon için Claude API faturasını düşürme yöntemlerine effort seviyesini de ekleyin.

xhigh ve max, max_tokens ile nasıl etkileşir?

max_tokens, yalnızca görünür yanıtı değil, düşünme tokenları ve yanıt tokenlarını birlikte sınırlar.

Effort seviyesini yükselttiğinizde model, yanıt üretmeden önce bu bütçenin daha büyük bölümünü muhakemeye ayırabilir. max_tokens değerini düşük bırakarak xhigh veya max kullanırsanız model, yanıtı tamamlamadan token sınırına ulaşabilir.

Başlangıç yapılandırması olarak Anthropic, Opus 5'te xhigh veya max kullanırken max_tokens: 64000 değerini önerir:

{
  "model": "claude-opus-5",
  "max_tokens": 64000,
  "output_config": { "effort": "xhigh" },
  "messages": [
    {
      "role": "user",
      "content": "Fix the failing integration test and explain the root cause."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Yüksek bir max_tokens değeri, peşin satın alınmış bir token paketi değildir. Yalnızca gerçekten üretilen tokenlar için ücretlendirilirsiniz. Bu değer sadece modelin muhakeme veya yanıt sırasında erken kesilmesini önlemek için üst sınır sağlar.

thinking: disabled ile xhigh veya max kullanmayın

Aşağıdaki istek başarısız olur:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "thinking": { "type": "disabled" },
  "output_config": { "effort": "xhigh" }
}
Enter fullscreen mode Exit fullscreen mode

Bu kombinasyon istek bazında 400 hatası döndürür.

Düşünmeyi devre dışı bırakmak ile yüksek effort talep etmek çelişkili talimatlardır. thinking: { "type": "disabled" } kullanıldığında effort seviyesi en fazla high olabilir.

Geçerli kombinasyonlar:

  • Düşünme açıkken — varsayılan durum — beş effort seviyesinin tamamı
  • Düşünme devre dışıyken yalnızca low, medium veya high

Geçiş sırasında şu hata kolayca oluşur:

  1. Opus 4.8 yapılandırmasından thinking: { "type": "disabled" } alanını taşırsınız.
  2. Kodlama önerisi nedeniyle effort'u xhigh yaparsınız.
  3. İstek 400 hatası döndürür.

Anthropic'in Opus 5 için önerisi düşünmeyi devre dışı bırakmamak, maliyeti daha düşük bir effort seviyesiyle kontrol etmektir.

Düşünme kapatıldığında iki hata modu görülebilir:

  • Çalıştırılmayan araç çağrılarının düz metin olarak görünmesi
  • Dahili XML etiketlerinin görünür çıktıya sızması

Bu durumlar özellikle temsilci döngülerinde sonraki dönüşleri etkileyebilir. Ayrıntılar için Opus 5 istem rehberine bakın.

Kendi effort değerlendirmenizi yapın

Effort seviyesi seçimini varsayımla değil, gerçek görevlerinizle yapın. Bir öğleden sonrada uygulanabilecek süreç aşağıdaki gibidir.

1. Görev setini dondurun

Üretim günlüklerinden 30–50 gerçek istem seçin. Yalnızca kolay örnekleri değil, gerçekten hata riskinin yüksek olduğu uç durumları da ekleyin.

Örnek görev grupları:

  • Bozuk JSON veya eksik alan içeren çıkarma istekleri
  • Karmaşık kod düzeltme görevleri
  • Çok adımlı araç kullanımı
  • Birden fazla kural içeren sınıflandırma
  • Uzun bağlamda belge tabanlı Soru-Cevap

2. Başarı kriterini çalıştırmadan önce tanımlayın

Yanıtları görmeden önce geçme koşulunu yazın.

Örnek kriterler:

  • Test paketi başarılı mı?
  • Çıktı JSON şemasını doğruluyor mu?
  • Çıkarılan alanlar temel gerçekle eşleşiyor mu?
  • İnsan değerlendirici görevi başarılı buluyor mu?
  • Araç çağrısı doğru sırada ve gerekli argümanlarla yapıldı mı?

Kriteriniz ölçülebilir değilse effort testi de güvenilir olmaz.

3. Her istemi her effort seviyesinde çalıştırın

40 istem ve beş seviye, toplam 200 çağrı eder:

40 istem × 5 effort seviyesi = 200 çağrı
Enter fullscreen mode Exit fullscreen mode

Gecikmeye duyarlı olmayan bu değerlendirmeyi Toplu İş API'si üzerinden çalıştırmak maliyeti düşürebilir.

4. Her çalıştırmada üç metriği kaydedin

Her yanıt için en az şunları saklayın:

  • Başarılı / başarısız
  • usage.output_tokens
  • Gerçek zaman gecikmesi

Örnek kayıt şeması:

{
  "prompt_id": "integration-test-017",
  "effort": "medium",
  "passed": true,
  "output_tokens": 1248,
  "latency_ms": 3920
}
Enter fullscreen mode Exit fullscreen mode

usage bloğu, gerçek maliyet sinyalini sağlar. Muhakeme tokenlarını tahmin etmek yerine yanıtın kullanım bilgisini kaydedin.

5. Başarı eşiğini geçen en düşük maliyetli seviyeyi seçin

Örnek karar tablosu:

Effort Başarı oranı Ort. output token Ort. gecikme Karar
low %91 650 1,2 sn Yetersiz
medium %97 980 1,8 sn Uygun
high %97 1.540 3,1 sn Gereksiz maliyet
xhigh %98 3.900 8,4 sn Yalnızca zor görevlerde
max %98 6.100 12,6 sn Ölçülebilir ek fayda yok

Bu örnekte üretim varsayılanı medium olabilir; ancak zor kod düzeltme akışları için xhigh ayrı bir rota olarak korunabilir.

Seçtiğiniz yapılandırmayı, ayar yaparken kullanmadığınız bir holdout veri kümesinde doğrulayın.

6. Her yeni model sürümünde testi tekrar çalıştırın

Bu değerlendirme bir defalık değildir. Opus 4.8 ve Opus 5 arasındaki yeniden kalibrasyon, effort etiketlerinin sürümler arasında aynı anlama gelmeyebileceğini gösterir.

Apidog'da effort seviyelerini yan yana karşılaştırma

Mekanik olarak yapmanız gereken işlem basittir: aynı istek gövdesini yalnızca output_config.effort alanını değiştirerek beş kez çalıştırmak.

Apidog ile uygulanabilir bir kurulum:

  1. Anthropic Mesajlar uç noktası için bir istek oluşturun.
  2. API anahtarını gövdeye yazmak yerine ortam değişkeninde saklayın.
  3. Çalışan isteği bir koleksiyona kaydedin.
  4. İsteği beş kez çoğaltın.
  5. Her kopyada yalnızca output_config.effort değerini değiştirin.
  6. Her yanıtta usage nesnesini kaydedin.
  7. cache_read_input_tokens değerini inceleyerek önbellek davranışını kontrol edin.
  8. Gecikme farkını görmek için akışı açın ve SSE olaylarını inceleyin.
  9. Kesilmiş yanıtları yakalamak için stop_reason üzerinde bir doğrulama ekleyin.

Özellikle şu durumu hata olarak işaretleyin:

stop_reason == "max_tokens"
Enter fullscreen mode Exit fullscreen mode

Bu kontrol önemlidir. Yüksek effort seviyesinde düşük max_tokens kullanıldığında, kesilmiş bir xhigh yanıtı normal ama kısa bir cevap gibi görünebilir.

Karşılaştırma koleksiyonunu oluşturmak için Apidog'u indirin. Bu araç zorunlu değildir; ancak beş ayrı kabuk betiğini sürdürmek yerine istekleri, ortamları ve yanıtları tek yerde karşılaştırmayı kolaylaştırır.

Dürüst üst sınır

Effort, Opus 5'i daha düşük maliyetle uygun performansta çalıştırmanıza yardımcı olur. Ancak modeli Claude yığınının en yetenekli modeli hâline getirmez.

Anthropic'in Opus 5 için yayınladığı lansman sayıları şunları içerir:

  • Opus 4.8'in Frontier-Bench v0.1 puanının iki katından fazlası
  • ARC-AGI 3'te sonraki en iyi modelin yaklaşık üç katı
  • CursorBench 3.2'de Fable 5'in %0,5'i içinde, yarı fiyatına

Bunlar Anthropic tarafından yayınlanan, satıcı tarafından yürütülen rakamlardır ve 25 Temmuz 2026 itibarıyla bağımsız biçimde yeniden üretilmemiştir. Bu nedenle bunları tarafsız ölçümler değil, kaynaklı satıcı iddiaları olarak değerlendirin. Uyarılar için Opus 5 karşılaştırma dökümüne bakın.

Opus 5'in üzerinde, Fable 5 hâlâ Anthropic'in geniş çapta piyasaya sürülmüş en yetenekli modelidir; milyon giriş tokenı başına 10 dolar, milyon çıkış tokenı başına 50 dolar fiyatlandırılır.

Opus 5 ayrıca siber güvenlik istismarı ve otonom biyoloji araştırmalarında Mythos 5 seviyesinde değildir. max effort kullanmak bu yetenek farkını kapatmaz.

İş yükünüz için fiyat farkının anlamlı olup olmadığını değerlendirmek üzere Opus 5 vs Fable 5 karşılaştırmasına bakın.

Sıkça Sorulan Sorular

Claude Opus 5'te varsayılan effort seviyesi nedir?

high. output_config alanı olmayan bir istek, adaptif düşünme açıkken high effort seviyesinde çalışır.

Beş effort seviyesi nelerdir?

low, medium, high, xhigh ve max. Anthropic, kodlama ve temsilci iş yüklerinde xhigh ile başlamayı, ardından kendi değerlendirmelerinize göre daha düşük seviyeleri denemeyi önerir.

xhigh kullandığımda isteğim neden 400 hatası döndürüyor?

Muhtemelen aynı istekte thinking: { "type": "disabled" } gönderiyorsunuz. Düşünme devre dışıyken effort en fazla high olabilir. Devre dışı bırakılmış düşünme bloğunu kaldırın veya effort'u high ya da altına indirin.

Opus 4.8 effort ayarlarımı Opus 5'te kullanabilir miyim?

Doğrudan kullanmayın. Seviyeler yeniden kalibre edildiği için aynı etiket farklı bir muhakeme miktarını ifade edebilir. Yeni bir değerlendirme çalıştırın. Geçiş ayrıntıları için geçiş rehberine bakın.

Effort'u düşürmek yanıtları kısaltır mı?

Hayır. Effort, görünür metin uzunluğunu değil, muhakeme bütçesini kontrol eder. Daha kısa çıktı istiyorsanız istemde uzunluk sınırı belirtin.

xhigh veya max için hangi max_tokens değerini kullanmalıyım?

64000 ile başlayın. max_tokens, düşünme ve yanıt tokenlarını birlikte sınırlar. Yalnızca üretilen tokenlar için faturalandırıldığınızdan, yüksek üst sınır tek başına ek maliyet oluşturmaz.

Teknik özellikler, kullanılabilirlik matrisi ve fiyatlandırma bağlamı için Claude Opus 5 nedir rehberiyle başlayın.

Top comments (0)