DEV Community

Cover image for GPT-6.1 Sol API Nasıl Kullanılır?
Tobias Hoffmann
Tobias Hoffmann

Posted on Originally published at apidog.com

GPT-6.1 Sol API Nasıl Kullanılır?

GPT-6.1 Sol API'yi çağırmak için https://api.openai.com/v1/responses adresine "model": "gpt-6.1-sol" ile bir POST isteği gönderin ve API anahtarınızı Bearer token olarak iletin. GPT-6 Sol ile aynı şekilde milyon token başına 2 dolar giriş ve 10 dolar çıkış fiyatına sahiptir. Ancak önbelleğe alınmış giriş fiyatı 0,20 dolardan 0,10 dolara düşer. gpt-6-sol'dan geçiş çoğunlukla bir model ID'si değişikliğidir. Kritik fark, çaba seviyesidir: GPT-6.1 Sol none veya minimal kabul etmez. Bu nedenle none kullanan tüm çağrıları low seviyesine taşımanız gerekir.

Apidog'u bugün deneyin

OpenAI, GPT-6.1 Sol'u 29 Eylül 2026'daki DevDay etkinliğinde duyurdu. DevDay 2026 özeti diğer lansmanları, GPT-6.1 Sol nedir ise performans testlerini ele alır. Bu rehberde ilk isteğinizi gönderecek, uygun çaba seviyesini seçecek, geçiş değişikliklerini uygulayacak, Batch/Flex/Fast katmanlarını değerlendirecek ve üretime geçmeden önce iki model ID'sini Apidog üzerinde karşılaştıracaksınız.

GPT-6 Sol vs GPT-6.1 Sol: API'de neler değişiyor?

Spesifikasyonun büyük kısmı aynı kalır. Ayrıntılar için GPT-6.1 Sol model sayfasına, GPT-6 Sol model sayfasına ve OpenAI'ın GPT-6 geçiş kılavuzuna bakın.

Özellik gpt-6-sol gpt-6.1-sol Yapılacaklar
1M token başına giriş / çıkış, Standart $2 / $10 $2 / $10 Değişiklik yok
1M token başına önbelleğe alınmış giriş $0,20 $0,10 Önbellek maliyeti hesabını güncelleyin
1M token başına önbellek yazma $2,50 $2,50 Değişiklik yok
Bağlam penceresi / maks. giriş / maks. çıkış 1.050.000 / 922.000 / 128.000 1.050.000 / 922.000 / 128.000 Değişiklik yok
Bilgi kesme tarihi 20 Nisan 2026 30 Nisan 2026 Tarihe duyarlı testleri tekrar çalıştırın
reasoning.effort none, low, medium, high, xhigh, max low, medium, high, xhigh, max none değerini low ile değiştirin
Sohbet Tamamlamalarında fonksiyon çağırma Yalnızca reasoning_effort: "none" ile Desteklenmiyor Araç çağrılarını Yanıtlar API'sine taşıyın
Uç noktalar Sohbet Tamamlamaları, Yanıtlar, Toplu İş Aynı Değişiklik yok
Oran sınırları Katman 1: 500 RPM / 500K TPM; Katman 5: 15.000 RPM / 40M TPM Aynı Değişiklik yok

GPT-6 Sol model sayfası artık GPT-6.1 Sol'u “daha yeni Sol modeli” olarak önerir.

İlk GPT-6.1 Sol isteğinizi gönderin

Önce API anahtarını ortam değişkenine ekleyin:

export OPENAI_API_KEY="..."
Enter fullscreen mode Exit fullscreen mode

Ardından Yanıtlar API'sine istek gönderin:

curl https://api.openai.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "medium"},
    "input": "List three ways a webhook retry policy can create duplicate orders. One line each."
  }'
Enter fullscreen mode Exit fullscreen mode

Python SDK aynı ortam değişkenini otomatik olarak okur:

from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-6.1-sol",
    reasoning={"effort": "medium"},
    input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)

print(response.output_text)
print(response.usage)
Enter fullscreen mode Exit fullscreen mode

Yanıtı işlerken şu alanları kontrol edin:

  • status, başarılı çağrılarda completed olur.
  • Çıktı bütçesi tükenirse status değeri incomplete olabilir ve incomplete_details.reason alanı max_output_tokens olarak dönebilir.
  • output bir dizidir. Yanıt metnini indeks numarasına göre değil, type: "message" öğesine göre bulun.
  • usage.output_tokens, çıktı fiyatından ücretlendirilen muhakeme tokenlarını içerir.
  • usage.output_tokens_details.reasoning_tokens, kullanılan muhakeme tokenı sayısını gösterir.
  • usage.input_tokens_details, cached_tokens ve cache_write_tokens değerlerini içerir.

OpenAI muhakeme kılavuzu, test aşamasında muhakeme ve çıktı için en az 25.000 token ayırmayı önerir.

Araç çağrıları içeren akışlarda Yanıtlar API'sini kullanın. GPT-6.1 Sol, Sohbet Tamamlamalarını yalnızca araç içermeyen isteklerde destekler. İstek biçimi için Yanıtlar API kılavuzuna bakın.

Bir muhakeme çaba seviyesi seçin

reasoning.effort, ana kalite ve maliyet ayarınızdır. Belirtmezseniz varsayılan değer medium olur.

OpenAI model seçim kılavuzu, medium seviyesini karmaşık teknik işler ve revize edilecek koordineli çıktılar için; xhigh seviyesini ise cilalı çıktılar ve çelişkili kanıtlara dayalı kararlar için önerir.

Çaba Başlangıç kullanım alanı OpenAI'ın GPT-6.1 Sol için raporladıkları
low Sohbet, çıkarım, sınıflandırma ve daha önce none kullanan çağrılar Kullanıcı tarafından işaretlenmiş konuşmalarda gerçeğe dayalı hata oranı %11,4'ten %7,7'ye düşer
medium Aracılı otomasyonlar ve araç çağırma iş akışları AutomationBench 1.0.6'da aynı ayarda GPT-6 Sol'a göre +4,8 puan
high Zor hata ayıklama ve ayrıntılı planlama Ayara özgü iddia yok
xhigh Cilalı çıktılar ve uzun asenkron işler Ayara özgü iddia yok
max Bilgisayar kullanımı ve zor bilim görevleri OSWorld 2.0'da GPT-6 Sol'a göre +7 puan; Terminal-Bench Science 0.1'de görev başına 5,47 dolar

Bu sonuçlar OpenAI tarafından raporlanmıştır. Gerçeklik veri seti normal trafik değil, daha önce hatalı olarak işaretlenmiş konuşmalardan oluşur. Ayrıca Terminal-Bench Science'da GPT-6 Astra en yüksek puanı almaya devam eder; OpenAI en zor bilimsel işler için Astra'yı önerir.

none kullanan çağrılar için geçiş

Gecikmeye duyarlı ve daha önce none kullanan isteklerde şu sırayı izleyin:

  1. none değerini low ile değiştirin.
  2. Temsili üretim istekleriyle gecikme, maliyet ve kalite ölçümü yapın.
  3. Çıktı şeması, araç çağrıları ve hata oranı için regresyon testleri çalıştırın.
  4. Sonuçlara göre medium veya daha yüksek seviyelere geçin.

Konuşma sırasında istem önbelleğini bozmadan çaba düzeyini değiştirmek için, istek düzeyindeki reasoning.effort alanını değiştirmek yerine bir configuration_update giriş öğesi kullanın.

gpt-6-sol'dan geçiş: dört kod değişikliği

1. Model ID'sini değiştirin

gpt-6-sol yerine gpt-6.1-sol kullanın. Geri almayı kolaylaştırmak için model adını yapılandırma veya ortam değişkeninde tutun:

export MODEL_ID="gpt-6.1-sol"
Enter fullscreen mode Exit fullscreen mode
response = client.responses.create(
    model=os.environ["MODEL_ID"],
    reasoning={"effort": "medium"},
    input="...",
)
Enter fullscreen mode Exit fullscreen mode

2. none ve minimal değerlerini yeniden eşleyin

GPT-6.1 Sol, none ve minimal değerlerini desteklemez. Bu değerleri low ile eşleyin:

const effortMap = {
  none: "low",
  minimal: "low",
  low: "low",
  medium: "medium",
  high: "high",
  xhigh: "xhigh",
  max: "max",
};

const effort = effortMap[currentEffort] ?? "medium";
Enter fullscreen mode Exit fullscreen mode

minimal kullanan akışlarda low ile başlayın ve temsili görevlerle karşılaştırma yapın.

3. Örnekleme parametrelerini kaldırın

Çaba seviyesi none olmadığında temperature, top_p, top_logprobs ve Sohbet Tamamlamalarındaki logprobs alanlarını kaldırın.

Örneğin eski kodunuz şöyleyse:

{
  "model": "gpt-6-sol",
  "reasoning_effort": "none",
  "temperature": 0,
  "top_p": 1
}
Enter fullscreen mode Exit fullscreen mode

GPT-6.1 Sol için şu biçime geçin:

{
  "model": "gpt-6.1-sol",
  "reasoning": {
    "effort": "low"
  }
}
Enter fullscreen mode Exit fullscreen mode

4. Araç çağrılarını Yanıtlar API'sine taşıyın

GPT-6 Sol, Sohbet Tamamlamalarında fonksiyon çağırmayı yalnızca reasoning_effort: "none" ile destekliyordu. GPT-6.1 Sol'da bu kombinasyonun karşılığı yoktur.

Araç kullanan tüm çağrıları Yanıtlar API'sine taşıyın.

Son olarak, bilgi kesme tarihine bağlı testleri tekrar çalıştırın: tarih 20 Nisan'dan 30 Nisan 2026'ya taşınır. GPT-6 Astra'dan Sol'a geçtiyseniz, Astra'dan Sol'a geçiş kılavuzunu kullanın.

Batch, Flex, Fast ve önbelleğe alınmış giriş fiyatlandırması

GPT-6.1 Sol, GPT-6 Sol ile aynı katman yapısını kullanır; yalnızca önbelleğe alınmış giriş maliyeti yarıya iner. Fiyatlar OpenAI API fiyatlandırma sayfasından alınmıştır.

Katman Giriş Önbelleğe alınmış giriş Önbellek yazmaları Çıkış
Standart $2,00 $0,10 $2,50 $10,00
Toplu $1,00 $0,05 $1,25 $5,00
Esnek $1,00 $0,05 $1,25 $5,00
Hızlı $4,00 $0,20 $5,00 $20,00
Standart, 272K giriş tokenını aşan istemler $4,00 $0,20 $5,00 $15,00

GPT-6.1 Sol model sayfasına göre, 272K giriş tokenını aşan istemlerde tüm istek için 2 kat giriş ve önbellek oranı, 1,5 kat çıktı oranı uygulanır.

Katman seçimi

  • Flex: İstek başına service_tier: "flex" kullanın.
  • Fast: service_tier: "fast" kullanın. "priority" bir takma ad olarak kabul edilir.
  • Fast sınırlaması: AB veri yerleşimi ile kullanılamaz.
  • Ultrafast: GPT-6.1 Sol için “yakında geliyor” durumundadır; bugün geniş ölçüde GPT-6 Astra için kullanılabilir. Ayrıntılar için OpenAI Ultrafast modu yazısına bakın.
  • Batch: Gece çalışan veya gecikmeye duyarsız işler için OpenAI Batch API kılavuzunu kullanın.

Önbellek maliyetini hesaplayın

İstem önbellekleme kılavuzuna göre:

  • GPT-6.1 Sol'da önbellek okumaları giriş fiyatının 0.05 katıdır.
  • GPT-6 Sol'da önbellek okumaları giriş fiyatının 0.1 katıdır.
  • Önbellek yazmaları iki modelde de giriş fiyatının 1.25 katıdır.

Örnek: 1.000 istekte tekrar kullanılan 50.000 tokenlık bir sistem istemi.

  • Bir önbellek yazması iki modelde de $0,125 tutar.
  • 999 okuma, GPT-6 Sol'da $9,99 tutar.
  • 999 okuma, GPT-6.1 Sol'da $5,00 tutar.

Önbelleğe alınabilir minimum önek 1.024 görünür tokendır. Önbelleğe alınan önek, son yazma veya yeniden kullanımdan sonra en az 30 dakika boyunca uygun kalır. Kesme noktası stratejileri için GPT-6 istem önbellekleme rehberine bakın.

Apidog'da değişimi test edin

Yalnızca liste fiyatlarına bakarak üretim trafiğini değiştirmeyin. Aynı kaydedilmiş isteği iki modele de gönderin; çıktı, kullanım ve maliyeti karşılaştırın.

Apidog içinde aşağıdaki akışı kurun.

1. Ortam değişkenlerini oluşturun

Şu değişkenleri tanımlayın:

  • OPENAI_API_KEY: Gizli olarak saklayın.
  • MODEL_ID: İlk çalıştırmada gpt-6-sol.
  • EFFORT: Başlangıçta medium.

2. Yanıtlar API isteğini kaydedin

POST https://api.openai.com/v1/responses isteğini oluşturun.

Başlık:

Authorization: Bearer {{OPENAI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode

Gövde:

{
  "model": "{{MODEL_ID}}",
  "reasoning": {
    "effort": "{{EFFORT}}"
  },
  "max_output_tokens": 25000,
  "input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
Enter fullscreen mode Exit fullscreen mode

3. Yanıt doğrulamalarını ekleyin

En az şu doğrulamaları ekleyin:

  • HTTP durum kodu 200
  • $.status değeri completed
  • $.output[*].type içinde message
  • $.usage.output_tokens değeri 0'dan büyük
  • $.usage.output_tokens_details.reasoning_tokens alanı mevcut

Bunlara ek olarak, uygulamanızın bağımlı olduğu çıktı sözleşmesini test edin. Örneğin, ayrıştırdığınız anahtarları içeren geçerli JSON dönmesini doğrulayın.

4. Çağrı maliyetini hesaplayan işlem sonrası betiği ekleyin

Aşağıdaki betik, usage alanını dolara çevirir:

const u = pm.response.json().usage;
const d = u.input_tokens_details || {};

const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");

const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;

const cost =
  (
    (u.input_tokens - cached - writes) * 2 +
    cached * cachedRate +
    writes * 2.5 +
    u.output_tokens * 10
  ) / 1e6;

console.log(model, "cost per call $", cost.toFixed(5));
Enter fullscreen mode Exit fullscreen mode

5. İki modeli karşılaştırın

  1. MODEL_ID=gpt-6-sol ile isteği çalıştırın.
  2. MODEL_ID=gpt-6.1-sol ile aynı isteği tekrar çalıştırın.
  3. Şu değerleri karşılaştırın:
    • reasoning_tokens
    • output_tokens
    • Çıktı doğruluğu ve şeması
    • Çağrı başına maliyet
    • Gecikme ve hata oranı

none değerinden geçiş yapıyorsanız, temel çizgiyi gpt-6-sol + none ile, adayı ise gpt-6.1-sol + low ile çalıştırın.

CI'da iki modeli de çalıştırın

İsteği ve temsili gerçek istemleri bir test senaryosuna taşıyın. Ardından Apidog CLI ile CI içinde iki modeli de çalıştırın:

npm install -g apidog-cli

apidog run \
  --access-token "$APIDOG_ACCESS_TOKEN" \
  -t "$SCENARIO_ID" \
  -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6-sol" \
  -r cli,junit

apidog run \
  --access-token "$APIDOG_ACCESS_TOKEN" \
  -t "$SCENARIO_ID" \
  -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6.1-sol" \
  -r cli,junit
Enter fullscreen mode Exit fullscreen mode

Başarısız bir doğrulama işi başarısız kılar. JUnit raporları iki çalıştırmayı karşılaştırmanıza yardımcı olur. Çalışmadan çalışmaya değişen model çıktılarında doğrulama tasarımı için deterministik olmayan yapay zeka ajanlarını test etme rehberine bakın.

Sıkça Sorulan Sorular

GPT-6.1 Sol, GPT-6 Sol'dan daha mı pahalı?

Hayır. Her iki model için de standart fiyat milyon token başına 2 dolar giriş ve 10 dolar çıkıştır. GPT-6.1 Sol'da önbelleğe alınmış giriş 0,20 dolar yerine 0,10 dolardır. Bu nedenle önbellek ağırlıklı iş yükleri daha düşük maliyetli olabilir.

reasoning.effort: "none" ile ne yapmalıyım?

GPT-6.1 Sol, none ve minimal değerlerini desteklemez. Her ikisini de low ile eşleyin, temperature ve top_p alanlarını kaldırın, ardından geçişten önce değerlendirmelerinizi tekrar çalıştırın.

GPT-6.1 Sol'u Sohbet Tamamlamaları ile kullanabilir miyim?

Evet, araç içermeyen isteklerde kullanabilirsiniz. Araç çağırma için Yanıtlar API'sini kullanmanız gerekir.

Ücretsiz bir GPT-6.1 Sol API katmanı var mı?

Hayır. API çağrıları ilk istekten itibaren token başına ücretlendirilir. En düşük maliyetli kullanım seçenekleri için GPT-6.1 Sol ücretsiz mi? yazısına bakın.

Sonraki adım

İlk isteğinizi kaydedin. Mevcut çaba ayarınızla önce gpt-6-sol, ardından gpt-6.1-sol üzerinde çalıştırın. Kendi trafiğinizden temsili istemlerle usage, maliyet, gecikme ve çıktı sözleşmesini karşılaştırın.

Bu karşılaştırmayı CI'da tekrar çalıştırılabilir doğrulamalar olarak saklamak için Apidog'u indirin. Anthropic alternatifini de değerlendiriyorsanız GPT-6.1 Sol vs Claude Sonnet 5.5 karşılaştırmasına bakın.

Top comments (0)