GPT-6.1 Sol API'yi çağırmak için https://api.openai.com/v1/responses adresine "model": "gpt-6.1-sol" ile bir POST isteği gönderin ve API anahtarınızı Bearer token olarak iletin. GPT-6 Sol ile aynı şekilde milyon token başına 2 dolar giriş ve 10 dolar çıkış fiyatına sahiptir. Ancak önbelleğe alınmış giriş fiyatı 0,20 dolardan 0,10 dolara düşer. gpt-6-sol'dan geçiş çoğunlukla bir model ID'si değişikliğidir. Kritik fark, çaba seviyesidir: GPT-6.1 Sol none veya minimal kabul etmez. Bu nedenle none kullanan tüm çağrıları low seviyesine taşımanız gerekir.
OpenAI, GPT-6.1 Sol'u 29 Eylül 2026'daki DevDay etkinliğinde duyurdu. DevDay 2026 özeti diğer lansmanları, GPT-6.1 Sol nedir ise performans testlerini ele alır. Bu rehberde ilk isteğinizi gönderecek, uygun çaba seviyesini seçecek, geçiş değişikliklerini uygulayacak, Batch/Flex/Fast katmanlarını değerlendirecek ve üretime geçmeden önce iki model ID'sini Apidog üzerinde karşılaştıracaksınız.
GPT-6 Sol vs GPT-6.1 Sol: API'de neler değişiyor?
Spesifikasyonun büyük kısmı aynı kalır. Ayrıntılar için GPT-6.1 Sol model sayfasına, GPT-6 Sol model sayfasına ve OpenAI'ın GPT-6 geçiş kılavuzuna bakın.
| Özellik | gpt-6-sol |
gpt-6.1-sol |
Yapılacaklar |
|---|---|---|---|
| 1M token başına giriş / çıkış, Standart | $2 / $10 | $2 / $10 | Değişiklik yok |
| 1M token başına önbelleğe alınmış giriş | $0,20 | $0,10 | Önbellek maliyeti hesabını güncelleyin |
| 1M token başına önbellek yazma | $2,50 | $2,50 | Değişiklik yok |
| Bağlam penceresi / maks. giriş / maks. çıkış | 1.050.000 / 922.000 / 128.000 | 1.050.000 / 922.000 / 128.000 | Değişiklik yok |
| Bilgi kesme tarihi | 20 Nisan 2026 | 30 Nisan 2026 | Tarihe duyarlı testleri tekrar çalıştırın |
reasoning.effort |
none, low, medium, high, xhigh, max
|
low, medium, high, xhigh, max
|
none değerini low ile değiştirin |
| Sohbet Tamamlamalarında fonksiyon çağırma | Yalnızca reasoning_effort: "none" ile |
Desteklenmiyor | Araç çağrılarını Yanıtlar API'sine taşıyın |
| Uç noktalar | Sohbet Tamamlamaları, Yanıtlar, Toplu İş | Aynı | Değişiklik yok |
| Oran sınırları | Katman 1: 500 RPM / 500K TPM; Katman 5: 15.000 RPM / 40M TPM | Aynı | Değişiklik yok |
GPT-6 Sol model sayfası artık GPT-6.1 Sol'u “daha yeni Sol modeli” olarak önerir.
İlk GPT-6.1 Sol isteğinizi gönderin
Önce API anahtarını ortam değişkenine ekleyin:
export OPENAI_API_KEY="..."
Ardından Yanıtlar API'sine istek gönderin:
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "List three ways a webhook retry policy can create duplicate orders. One line each."
}'
Python SDK aynı ortam değişkenini otomatik olarak okur:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "medium"},
input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)
print(response.output_text)
print(response.usage)
Yanıtı işlerken şu alanları kontrol edin:
-
status, başarılı çağrılardacompletedolur. - Çıktı bütçesi tükenirse
statusdeğeriincompleteolabilir veincomplete_details.reasonalanımax_output_tokensolarak dönebilir. -
outputbir dizidir. Yanıt metnini indeks numarasına göre değil,type: "message"öğesine göre bulun. -
usage.output_tokens, çıktı fiyatından ücretlendirilen muhakeme tokenlarını içerir. -
usage.output_tokens_details.reasoning_tokens, kullanılan muhakeme tokenı sayısını gösterir. -
usage.input_tokens_details,cached_tokensvecache_write_tokensdeğerlerini içerir.
OpenAI muhakeme kılavuzu, test aşamasında muhakeme ve çıktı için en az 25.000 token ayırmayı önerir.
Araç çağrıları içeren akışlarda Yanıtlar API'sini kullanın. GPT-6.1 Sol, Sohbet Tamamlamalarını yalnızca araç içermeyen isteklerde destekler. İstek biçimi için Yanıtlar API kılavuzuna bakın.
Bir muhakeme çaba seviyesi seçin
reasoning.effort, ana kalite ve maliyet ayarınızdır. Belirtmezseniz varsayılan değer medium olur.
OpenAI model seçim kılavuzu, medium seviyesini karmaşık teknik işler ve revize edilecek koordineli çıktılar için; xhigh seviyesini ise cilalı çıktılar ve çelişkili kanıtlara dayalı kararlar için önerir.
| Çaba | Başlangıç kullanım alanı | OpenAI'ın GPT-6.1 Sol için raporladıkları |
|---|---|---|
low |
Sohbet, çıkarım, sınıflandırma ve daha önce none kullanan çağrılar |
Kullanıcı tarafından işaretlenmiş konuşmalarda gerçeğe dayalı hata oranı %11,4'ten %7,7'ye düşer |
medium |
Aracılı otomasyonlar ve araç çağırma iş akışları | AutomationBench 1.0.6'da aynı ayarda GPT-6 Sol'a göre +4,8 puan |
high |
Zor hata ayıklama ve ayrıntılı planlama | Ayara özgü iddia yok |
xhigh |
Cilalı çıktılar ve uzun asenkron işler | Ayara özgü iddia yok |
max |
Bilgisayar kullanımı ve zor bilim görevleri | OSWorld 2.0'da GPT-6 Sol'a göre +7 puan; Terminal-Bench Science 0.1'de görev başına 5,47 dolar |
Bu sonuçlar OpenAI tarafından raporlanmıştır. Gerçeklik veri seti normal trafik değil, daha önce hatalı olarak işaretlenmiş konuşmalardan oluşur. Ayrıca Terminal-Bench Science'da GPT-6 Astra en yüksek puanı almaya devam eder; OpenAI en zor bilimsel işler için Astra'yı önerir.
none kullanan çağrılar için geçiş
Gecikmeye duyarlı ve daha önce none kullanan isteklerde şu sırayı izleyin:
-
nonedeğerinilowile değiştirin. - Temsili üretim istekleriyle gecikme, maliyet ve kalite ölçümü yapın.
- Çıktı şeması, araç çağrıları ve hata oranı için regresyon testleri çalıştırın.
- Sonuçlara göre
mediumveya daha yüksek seviyelere geçin.
Konuşma sırasında istem önbelleğini bozmadan çaba düzeyini değiştirmek için, istek düzeyindeki reasoning.effort alanını değiştirmek yerine bir configuration_update giriş öğesi kullanın.
gpt-6-sol'dan geçiş: dört kod değişikliği
1. Model ID'sini değiştirin
gpt-6-sol yerine gpt-6.1-sol kullanın. Geri almayı kolaylaştırmak için model adını yapılandırma veya ortam değişkeninde tutun:
export MODEL_ID="gpt-6.1-sol"
response = client.responses.create(
model=os.environ["MODEL_ID"],
reasoning={"effort": "medium"},
input="...",
)
2. none ve minimal değerlerini yeniden eşleyin
GPT-6.1 Sol, none ve minimal değerlerini desteklemez. Bu değerleri low ile eşleyin:
const effortMap = {
none: "low",
minimal: "low",
low: "low",
medium: "medium",
high: "high",
xhigh: "xhigh",
max: "max",
};
const effort = effortMap[currentEffort] ?? "medium";
minimal kullanan akışlarda low ile başlayın ve temsili görevlerle karşılaştırma yapın.
3. Örnekleme parametrelerini kaldırın
Çaba seviyesi none olmadığında temperature, top_p, top_logprobs ve Sohbet Tamamlamalarındaki logprobs alanlarını kaldırın.
Örneğin eski kodunuz şöyleyse:
{
"model": "gpt-6-sol",
"reasoning_effort": "none",
"temperature": 0,
"top_p": 1
}
GPT-6.1 Sol için şu biçime geçin:
{
"model": "gpt-6.1-sol",
"reasoning": {
"effort": "low"
}
}
4. Araç çağrılarını Yanıtlar API'sine taşıyın
GPT-6 Sol, Sohbet Tamamlamalarında fonksiyon çağırmayı yalnızca reasoning_effort: "none" ile destekliyordu. GPT-6.1 Sol'da bu kombinasyonun karşılığı yoktur.
Araç kullanan tüm çağrıları Yanıtlar API'sine taşıyın.
Son olarak, bilgi kesme tarihine bağlı testleri tekrar çalıştırın: tarih 20 Nisan'dan 30 Nisan 2026'ya taşınır. GPT-6 Astra'dan Sol'a geçtiyseniz, Astra'dan Sol'a geçiş kılavuzunu kullanın.
Batch, Flex, Fast ve önbelleğe alınmış giriş fiyatlandırması
GPT-6.1 Sol, GPT-6 Sol ile aynı katman yapısını kullanır; yalnızca önbelleğe alınmış giriş maliyeti yarıya iner. Fiyatlar OpenAI API fiyatlandırma sayfasından alınmıştır.
| Katman | Giriş | Önbelleğe alınmış giriş | Önbellek yazmaları | Çıkış |
|---|---|---|---|---|
| Standart | $2,00 | $0,10 | $2,50 | $10,00 |
| Toplu | $1,00 | $0,05 | $1,25 | $5,00 |
| Esnek | $1,00 | $0,05 | $1,25 | $5,00 |
| Hızlı | $4,00 | $0,20 | $5,00 | $20,00 |
| Standart, 272K giriş tokenını aşan istemler | $4,00 | $0,20 | $5,00 | $15,00 |
GPT-6.1 Sol model sayfasına göre, 272K giriş tokenını aşan istemlerde tüm istek için 2 kat giriş ve önbellek oranı, 1,5 kat çıktı oranı uygulanır.
Katman seçimi
-
Flex: İstek başına
service_tier: "flex"kullanın. -
Fast:
service_tier: "fast"kullanın."priority"bir takma ad olarak kabul edilir. - Fast sınırlaması: AB veri yerleşimi ile kullanılamaz.
- Ultrafast: GPT-6.1 Sol için “yakında geliyor” durumundadır; bugün geniş ölçüde GPT-6 Astra için kullanılabilir. Ayrıntılar için OpenAI Ultrafast modu yazısına bakın.
- Batch: Gece çalışan veya gecikmeye duyarsız işler için OpenAI Batch API kılavuzunu kullanın.
Önbellek maliyetini hesaplayın
İstem önbellekleme kılavuzuna göre:
- GPT-6.1 Sol'da önbellek okumaları giriş fiyatının
0.05katıdır. - GPT-6 Sol'da önbellek okumaları giriş fiyatının
0.1katıdır. - Önbellek yazmaları iki modelde de giriş fiyatının
1.25katıdır.
Örnek: 1.000 istekte tekrar kullanılan 50.000 tokenlık bir sistem istemi.
- Bir önbellek yazması iki modelde de $0,125 tutar.
- 999 okuma, GPT-6 Sol'da $9,99 tutar.
- 999 okuma, GPT-6.1 Sol'da $5,00 tutar.
Önbelleğe alınabilir minimum önek 1.024 görünür tokendır. Önbelleğe alınan önek, son yazma veya yeniden kullanımdan sonra en az 30 dakika boyunca uygun kalır. Kesme noktası stratejileri için GPT-6 istem önbellekleme rehberine bakın.
Apidog'da değişimi test edin
Yalnızca liste fiyatlarına bakarak üretim trafiğini değiştirmeyin. Aynı kaydedilmiş isteği iki modele de gönderin; çıktı, kullanım ve maliyeti karşılaştırın.
Apidog içinde aşağıdaki akışı kurun.
1. Ortam değişkenlerini oluşturun
Şu değişkenleri tanımlayın:
-
OPENAI_API_KEY: Gizli olarak saklayın. -
MODEL_ID: İlk çalıştırmadagpt-6-sol. -
EFFORT: Başlangıçtamedium.
2. Yanıtlar API isteğini kaydedin
POST https://api.openai.com/v1/responses isteğini oluşturun.
Başlık:
Authorization: Bearer {{OPENAI_API_KEY}}
Gövde:
{
"model": "{{MODEL_ID}}",
"reasoning": {
"effort": "{{EFFORT}}"
},
"max_output_tokens": 25000,
"input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
3. Yanıt doğrulamalarını ekleyin
En az şu doğrulamaları ekleyin:
- HTTP durum kodu
200 -
$.statusdeğericompleted -
$.output[*].typeiçindemessage -
$.usage.output_tokensdeğeri0'dan büyük -
$.usage.output_tokens_details.reasoning_tokensalanı mevcut
Bunlara ek olarak, uygulamanızın bağımlı olduğu çıktı sözleşmesini test edin. Örneğin, ayrıştırdığınız anahtarları içeren geçerli JSON dönmesini doğrulayın.
4. Çağrı maliyetini hesaplayan işlem sonrası betiği ekleyin
Aşağıdaki betik, usage alanını dolara çevirir:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");
const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;
const cost =
(
(u.input_tokens - cached - writes) * 2 +
cached * cachedRate +
writes * 2.5 +
u.output_tokens * 10
) / 1e6;
console.log(model, "cost per call $", cost.toFixed(5));
5. İki modeli karşılaştırın
-
MODEL_ID=gpt-6-solile isteği çalıştırın. -
MODEL_ID=gpt-6.1-solile aynı isteği tekrar çalıştırın. - Şu değerleri karşılaştırın:
reasoning_tokensoutput_tokens- Çıktı doğruluğu ve şeması
- Çağrı başına maliyet
- Gecikme ve hata oranı
none değerinden geçiş yapıyorsanız, temel çizgiyi gpt-6-sol + none ile, adayı ise gpt-6.1-sol + low ile çalıştırın.
CI'da iki modeli de çalıştırın
İsteği ve temsili gerçek istemleri bir test senaryosuna taşıyın. Ardından Apidog CLI ile CI içinde iki modeli de çalıştırın:
npm install -g apidog-cli
apidog run \
--access-token "$APIDOG_ACCESS_TOKEN" \
-t "$SCENARIO_ID" \
-e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6-sol" \
-r cli,junit
apidog run \
--access-token "$APIDOG_ACCESS_TOKEN" \
-t "$SCENARIO_ID" \
-e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6.1-sol" \
-r cli,junit
Başarısız bir doğrulama işi başarısız kılar. JUnit raporları iki çalıştırmayı karşılaştırmanıza yardımcı olur. Çalışmadan çalışmaya değişen model çıktılarında doğrulama tasarımı için deterministik olmayan yapay zeka ajanlarını test etme rehberine bakın.
Sıkça Sorulan Sorular
GPT-6.1 Sol, GPT-6 Sol'dan daha mı pahalı?
Hayır. Her iki model için de standart fiyat milyon token başına 2 dolar giriş ve 10 dolar çıkıştır. GPT-6.1 Sol'da önbelleğe alınmış giriş 0,20 dolar yerine 0,10 dolardır. Bu nedenle önbellek ağırlıklı iş yükleri daha düşük maliyetli olabilir.
reasoning.effort: "none" ile ne yapmalıyım?
GPT-6.1 Sol, none ve minimal değerlerini desteklemez. Her ikisini de low ile eşleyin, temperature ve top_p alanlarını kaldırın, ardından geçişten önce değerlendirmelerinizi tekrar çalıştırın.
GPT-6.1 Sol'u Sohbet Tamamlamaları ile kullanabilir miyim?
Evet, araç içermeyen isteklerde kullanabilirsiniz. Araç çağırma için Yanıtlar API'sini kullanmanız gerekir.
Ücretsiz bir GPT-6.1 Sol API katmanı var mı?
Hayır. API çağrıları ilk istekten itibaren token başına ücretlendirilir. En düşük maliyetli kullanım seçenekleri için GPT-6.1 Sol ücretsiz mi? yazısına bakın.
Sonraki adım
İlk isteğinizi kaydedin. Mevcut çaba ayarınızla önce gpt-6-sol, ardından gpt-6.1-sol üzerinde çalıştırın. Kendi trafiğinizden temsili istemlerle usage, maliyet, gecikme ve çıktı sözleşmesini karşılaştırın.
Bu karşılaştırmayı CI'da tekrar çalıştırılabilir doğrulamalar olarak saklamak için Apidog'u indirin. Anthropic alternatifini de değerlendiriyorsanız GPT-6.1 Sol vs Claude Sonnet 5.5 karşılaştırmasına bakın.
Top comments (0)