24 Temmuz 2026'daki Claude Opus 5 lansmanında ana akım yazıların çoğu aynı özellikten bahsetti: maliyet ve yetenek arasında geçiş yapma imkânı. Ancak bu geçişin API'de hangi parametreyle yapıldığı, seviyelerin ne anlama geldiği, maliyet ve gecikmeyi nasıl etkilediği çoğunlukla açıklanmadı.
Bu özellik, effort adlı bir istek parametresidir. Opus 5'te beş seviyesi vardır ve varsayılan değer high'dır. Anthropic, Opus 5 için seviyeleri yeniden kalibre etti. Bu nedenle Opus 4.8'den taşıdığınız effort ayarları doğrudan doğruya geçerli kabul edilmemelidir. Ayrıca belirli bir thinking ve effort kombinasyonu 400 hatası döndürür.
💡 Seviyeleri gerçek bir uç noktada karşılaştırmak için aynı isteği beş farklı effort ayarıyla gönderin; dönen yanıtları,
usagedeğerlerini ve gecikmeleri yan yana inceleyin. Bunu Apidog ile koleksiyon halinde yönetebilirsiniz.
Effort parametresi nedir?
effort, Mesajlar API isteğindeki output_config nesnesinde yer alır:
{
"model": "claude-opus-5",
"max_tokens": 8192,
"output_config": { "effort": "high" },
"messages": [
{
"role": "user",
"content": "Refactor this module and explain the tradeoffs."
}
]
}
Bu parametre, modelin görünür yanıtı üretmeden önce ne kadar dahili muhakeme bütçesi kullanacağını kontrol eder.
- Daha yüksek effort: daha fazla muhakeme jetonu, maliyet ve gecikme
- Daha düşük effort: daha az muhakeme jetonu, maliyet ve gecikme
Tüketici arayüzlerinde bu genellikle bir effort seçici olarak görünür. API tarafında ise doğrudan kontrol ettiğiniz alan output_config.effort değeridir.
İsteğin tamamı için Opus 5 API kılavuzuna, parametre referansı için Anthropic'in modeller genel bakışına bakın.
Effort, çıktı uzunluğu ayarı değildir
Effort'u düşürmek, görünür yanıtı otomatik olarak kısaltmaz. Anthropic'in Opus 5 istem rehberi, effort'un görünen metin uzunluğunu değil, düşünme bütçesini azalttığını belirtir.
Daha kısa cevap istiyorsanız bunu istemde açıkça belirtin:
Yanıtı en fazla 5 maddeyle sınırla.
Kod açıklamasını 150 kelimeyi geçmeyecek şekilde yaz.
low kullanmak, tek başına daha kısa bir yanıt garantilemez.
Beş effort seviyesi
| Seviye | Ne işe yarar | Tipik kullanım |
|---|---|---|
low |
Minimal muhakeme | Yüksek hacimli sınıflandırma, çıkarma, yönlendirme, kısa özetler |
medium |
Orta düzey muhakeme | Geri çağrılan bağlamda Soru-Cevap, tek dosya düzenlemeleri, yapılandırılmış dönüşümler |
high |
Varsayılan. Önemli muhakeme | Henüz ölçüm yapmadığınız genel amaçlı işler |
xhigh |
Genişletilmiş muhakeme | Kodlama ve temsilci döngüleri |
max |
Maksimum muhakeme bütçesi | Hatalı cevabın token maliyetinden daha pahalı olduğu zor tek seferlik problemler |
Bu tabloda iki önemli nokta vardır.
1. Varsayılan seviye high'dır
İstekte output_config göndirmezseniz Opus 5 high seviyesinde çalışır:
{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Summarize this incident report."
}
]
}
Bu, maliyet tahminlerinde önemlidir. Opus 5'te değişiklik yapmadığınız bir istek bile muhakeme bütçesi kullanır. Opus 4.8'de aynı türde değiştirilmemiş bir istek düşünme çalıştırmıyorsa, geçiş sonrası harcamanız beklenmedik biçimde artabilir.
Bu, Opus 4.8'den Opus 5'e geçişteki kritik değişikliklerden biridir.
2. Kodlama ve temsilci işlerinde max ile değil, xhigh ile başlayın
Anthropic, kodlama ve temsilci iş yükleri için başlangıç noktası olarak xhigh önerir. max daha yüksek bir bütçe sağlar; ancak ölçülebilir bir yarar olmadan ekstra çıktı tarafı harcaması oluşturabilir.
Pratik yaklaşım:
-
xhighile bir temel ölçüm alın. - Aynı görevleri
high,mediumve gerekiyorsalowile çalıştırın. - Başarı kriterinizi karşılayan en düşük effort seviyesini seçin.
Yeniden kalibrasyon neyi değiştirdi?
Opus 5'teki effort seviyeleri, Opus 4.8 seviyeleriyle bire bir eşdeğer değildir.
Örneğin, Opus 5'teki medium, Opus 4.8'deki medium ile aynı miktarda muhakeme anlamına gelmez. Bu nedenle eski yapılandırmayı taşımak yerine Opus 5 üzerinde yeni bir effort değerlendirmesi çalıştırmanız gerekir.
Pratik sonuç şudur: Önceki Opus modellerinde low ve medium, ciddi üretim iş yükleri için çoğu ekipte yeterince güçlü görülmüyordu. Opus 5'te alt seviyeler daha güçlü olduğundan, low ve medium artık bazı üretim görevlerinde anlamlı seçenekler olabilir.
Bu özellikle şu tür iş yüklerinde maliyet avantajı sağlayabilir:
- Sınıflandırma
- Bilgi çıkarma
- Etiketleme
- Yönlendirme
- Yapılandırılmış dönüşüm
- Kısa özetleme
Opus 5, Opus 4.8 ile aynı şekilde milyon giriş tokenı başına 5 dolar ve milyon çıkış tokenı başına 25 dolar maliyetle sunulur. Muhakeme tokenları çıkış tarafında faturalandırılır. Bu nedenle doğruluk farkı yaratmayan bir sınıflandırma hattını high yerine low ile çalıştırmak, çıktı harcamasında anlamlı bir fark oluşturabilir.
Fiyatlandırma ayrıntıları, %50 toplu indirim ve 512 token önbellek minimumu için Opus 5 fiyatlandırma dökümüne bakın.
Daha geniş çaplı optimizasyon için Claude API faturasını düşürme yöntemlerine effort seviyesini de ekleyin.
xhigh ve max, max_tokens ile nasıl etkileşir?
max_tokens, yalnızca görünür yanıtı değil, düşünme tokenları ve yanıt tokenlarını birlikte sınırlar.
Effort seviyesini yükselttiğinizde model, yanıt üretmeden önce bu bütçenin daha büyük bölümünü muhakemeye ayırabilir. max_tokens değerini düşük bırakarak xhigh veya max kullanırsanız model, yanıtı tamamlamadan token sınırına ulaşabilir.
Başlangıç yapılandırması olarak Anthropic, Opus 5'te xhigh veya max kullanırken max_tokens: 64000 değerini önerir:
{
"model": "claude-opus-5",
"max_tokens": 64000,
"output_config": { "effort": "xhigh" },
"messages": [
{
"role": "user",
"content": "Fix the failing integration test and explain the root cause."
}
]
}
Yüksek bir max_tokens değeri, peşin satın alınmış bir token paketi değildir. Yalnızca gerçekten üretilen tokenlar için ücretlendirilirsiniz. Bu değer sadece modelin muhakeme veya yanıt sırasında erken kesilmesini önlemek için üst sınır sağlar.
thinking: disabled ile xhigh veya max kullanmayın
Aşağıdaki istek başarısız olur:
{
"model": "claude-opus-5",
"max_tokens": 8192,
"thinking": { "type": "disabled" },
"output_config": { "effort": "xhigh" }
}
Bu kombinasyon istek bazında 400 hatası döndürür.
Düşünmeyi devre dışı bırakmak ile yüksek effort talep etmek çelişkili talimatlardır. thinking: { "type": "disabled" } kullanıldığında effort seviyesi en fazla high olabilir.
Geçerli kombinasyonlar:
- Düşünme açıkken — varsayılan durum — beş effort seviyesinin tamamı
- Düşünme devre dışıyken yalnızca
low,mediumveyahigh
Geçiş sırasında şu hata kolayca oluşur:
- Opus 4.8 yapılandırmasından
thinking: { "type": "disabled" }alanını taşırsınız. - Kodlama önerisi nedeniyle effort'u
xhighyaparsınız. - İstek 400 hatası döndürür.
Anthropic'in Opus 5 için önerisi düşünmeyi devre dışı bırakmamak, maliyeti daha düşük bir effort seviyesiyle kontrol etmektir.
Düşünme kapatıldığında iki hata modu görülebilir:
- Çalıştırılmayan araç çağrılarının düz metin olarak görünmesi
- Dahili XML etiketlerinin görünür çıktıya sızması
Bu durumlar özellikle temsilci döngülerinde sonraki dönüşleri etkileyebilir. Ayrıntılar için Opus 5 istem rehberine bakın.
Kendi effort değerlendirmenizi yapın
Effort seviyesi seçimini varsayımla değil, gerçek görevlerinizle yapın. Bir öğleden sonrada uygulanabilecek süreç aşağıdaki gibidir.
1. Görev setini dondurun
Üretim günlüklerinden 30–50 gerçek istem seçin. Yalnızca kolay örnekleri değil, gerçekten hata riskinin yüksek olduğu uç durumları da ekleyin.
Örnek görev grupları:
- Bozuk JSON veya eksik alan içeren çıkarma istekleri
- Karmaşık kod düzeltme görevleri
- Çok adımlı araç kullanımı
- Birden fazla kural içeren sınıflandırma
- Uzun bağlamda belge tabanlı Soru-Cevap
2. Başarı kriterini çalıştırmadan önce tanımlayın
Yanıtları görmeden önce geçme koşulunu yazın.
Örnek kriterler:
- Test paketi başarılı mı?
- Çıktı JSON şemasını doğruluyor mu?
- Çıkarılan alanlar temel gerçekle eşleşiyor mu?
- İnsan değerlendirici görevi başarılı buluyor mu?
- Araç çağrısı doğru sırada ve gerekli argümanlarla yapıldı mı?
Kriteriniz ölçülebilir değilse effort testi de güvenilir olmaz.
3. Her istemi her effort seviyesinde çalıştırın
40 istem ve beş seviye, toplam 200 çağrı eder:
40 istem × 5 effort seviyesi = 200 çağrı
Gecikmeye duyarlı olmayan bu değerlendirmeyi Toplu İş API'si üzerinden çalıştırmak maliyeti düşürebilir.
4. Her çalıştırmada üç metriği kaydedin
Her yanıt için en az şunları saklayın:
- Başarılı / başarısız
usage.output_tokens- Gerçek zaman gecikmesi
Örnek kayıt şeması:
{
"prompt_id": "integration-test-017",
"effort": "medium",
"passed": true,
"output_tokens": 1248,
"latency_ms": 3920
}
usage bloğu, gerçek maliyet sinyalini sağlar. Muhakeme tokenlarını tahmin etmek yerine yanıtın kullanım bilgisini kaydedin.
5. Başarı eşiğini geçen en düşük maliyetli seviyeyi seçin
Örnek karar tablosu:
| Effort | Başarı oranı | Ort. output token | Ort. gecikme | Karar |
|---|---|---|---|---|
low |
%91 | 650 | 1,2 sn | Yetersiz |
medium |
%97 | 980 | 1,8 sn | Uygun |
high |
%97 | 1.540 | 3,1 sn | Gereksiz maliyet |
xhigh |
%98 | 3.900 | 8,4 sn | Yalnızca zor görevlerde |
max |
%98 | 6.100 | 12,6 sn | Ölçülebilir ek fayda yok |
Bu örnekte üretim varsayılanı medium olabilir; ancak zor kod düzeltme akışları için xhigh ayrı bir rota olarak korunabilir.
Seçtiğiniz yapılandırmayı, ayar yaparken kullanmadığınız bir holdout veri kümesinde doğrulayın.
6. Her yeni model sürümünde testi tekrar çalıştırın
Bu değerlendirme bir defalık değildir. Opus 4.8 ve Opus 5 arasındaki yeniden kalibrasyon, effort etiketlerinin sürümler arasında aynı anlama gelmeyebileceğini gösterir.
Apidog'da effort seviyelerini yan yana karşılaştırma
Mekanik olarak yapmanız gereken işlem basittir: aynı istek gövdesini yalnızca output_config.effort alanını değiştirerek beş kez çalıştırmak.
Apidog ile uygulanabilir bir kurulum:
- Anthropic Mesajlar uç noktası için bir istek oluşturun.
- API anahtarını gövdeye yazmak yerine ortam değişkeninde saklayın.
- Çalışan isteği bir koleksiyona kaydedin.
- İsteği beş kez çoğaltın.
- Her kopyada yalnızca
output_config.effortdeğerini değiştirin. - Her yanıtta
usagenesnesini kaydedin. -
cache_read_input_tokensdeğerini inceleyerek önbellek davranışını kontrol edin. - Gecikme farkını görmek için akışı açın ve SSE olaylarını inceleyin.
- Kesilmiş yanıtları yakalamak için
stop_reasonüzerinde bir doğrulama ekleyin.
Özellikle şu durumu hata olarak işaretleyin:
stop_reason == "max_tokens"
Bu kontrol önemlidir. Yüksek effort seviyesinde düşük max_tokens kullanıldığında, kesilmiş bir xhigh yanıtı normal ama kısa bir cevap gibi görünebilir.
Karşılaştırma koleksiyonunu oluşturmak için Apidog'u indirin. Bu araç zorunlu değildir; ancak beş ayrı kabuk betiğini sürdürmek yerine istekleri, ortamları ve yanıtları tek yerde karşılaştırmayı kolaylaştırır.
Dürüst üst sınır
Effort, Opus 5'i daha düşük maliyetle uygun performansta çalıştırmanıza yardımcı olur. Ancak modeli Claude yığınının en yetenekli modeli hâline getirmez.
Anthropic'in Opus 5 için yayınladığı lansman sayıları şunları içerir:
- Opus 4.8'in Frontier-Bench v0.1 puanının iki katından fazlası
- ARC-AGI 3'te sonraki en iyi modelin yaklaşık üç katı
- CursorBench 3.2'de Fable 5'in %0,5'i içinde, yarı fiyatına
Bunlar Anthropic tarafından yayınlanan, satıcı tarafından yürütülen rakamlardır ve 25 Temmuz 2026 itibarıyla bağımsız biçimde yeniden üretilmemiştir. Bu nedenle bunları tarafsız ölçümler değil, kaynaklı satıcı iddiaları olarak değerlendirin. Uyarılar için Opus 5 karşılaştırma dökümüne bakın.
Opus 5'in üzerinde, Fable 5 hâlâ Anthropic'in geniş çapta piyasaya sürülmüş en yetenekli modelidir; milyon giriş tokenı başına 10 dolar, milyon çıkış tokenı başına 50 dolar fiyatlandırılır.
Opus 5 ayrıca siber güvenlik istismarı ve otonom biyoloji araştırmalarında Mythos 5 seviyesinde değildir. max effort kullanmak bu yetenek farkını kapatmaz.
İş yükünüz için fiyat farkının anlamlı olup olmadığını değerlendirmek üzere Opus 5 vs Fable 5 karşılaştırmasına bakın.
Sıkça Sorulan Sorular
Claude Opus 5'te varsayılan effort seviyesi nedir?
high. output_config alanı olmayan bir istek, adaptif düşünme açıkken high effort seviyesinde çalışır.
Beş effort seviyesi nelerdir?
low, medium, high, xhigh ve max. Anthropic, kodlama ve temsilci iş yüklerinde xhigh ile başlamayı, ardından kendi değerlendirmelerinize göre daha düşük seviyeleri denemeyi önerir.
xhigh kullandığımda isteğim neden 400 hatası döndürüyor?
Muhtemelen aynı istekte thinking: { "type": "disabled" } gönderiyorsunuz. Düşünme devre dışıyken effort en fazla high olabilir. Devre dışı bırakılmış düşünme bloğunu kaldırın veya effort'u high ya da altına indirin.
Opus 4.8 effort ayarlarımı Opus 5'te kullanabilir miyim?
Doğrudan kullanmayın. Seviyeler yeniden kalibre edildiği için aynı etiket farklı bir muhakeme miktarını ifade edebilir. Yeni bir değerlendirme çalıştırın. Geçiş ayrıntıları için geçiş rehberine bakın.
Effort'u düşürmek yanıtları kısaltır mı?
Hayır. Effort, görünür metin uzunluğunu değil, muhakeme bütçesini kontrol eder. Daha kısa çıktı istiyorsanız istemde uzunluk sınırı belirtin.
xhigh veya max için hangi max_tokens değerini kullanmalıyım?
64000 ile başlayın. max_tokens, düşünme ve yanıt tokenlarını birlikte sınırlar. Yalnızca üretilen tokenlar için faturalandırıldığınızdan, yüksek üst sınır tek başına ek maliyet oluşturmaz.
Teknik özellikler, kullanılabilirlik matrisi ve fiyatlandırma bağlamı için Claude Opus 5 nedir rehberiyle başlayın.
Top comments (0)