لاستدعاء واجهة برمجة تطبيقات GPT-6.1 Sol، أرسل طلب POST إلى https://api.openai.com/v1/responses مع "model": "gpt-6.1-sol" ومفتاحك كرمز Bearer. يُسعّر بنفس سعر GPT-6 Sol: 2 دولار للمدخلات و10 دولارات للمخرجات لكل مليون رمز مميز، بينما ينخفض سعر المدخلات المخزنة مؤقتًا من 0.20 دولار إلى 0.10 دولار. الترحيل من gpt-6-sol هو غالبًا تبديل معرّف النموذج، لكن التغيير الجوهري هو مستوى الجهد: لا يقبل GPT-6.1 Sol القيمتين none أو minimal، لذا يجب نقل هذه الطلبات إلى low.
أطلقت OpenAI نموذج GPT-6.1 Sol في DevDay بتاريخ 29 سبتمبر 2026. يغطي ملخص DevDay 2026 الإطلاقات الأخرى، بينما يشرح ما هو GPT-6.1 Sol المعايير بمزيد من التفصيل. يركز هذا الدليل على تنفيذ أول طلب، واختيار مستوى الجهد، وخطوات الترحيل، وتسعير Batch وFlex وFast، ثم تشغيل اختبار تراجع متوازٍ لكلا معرّفي النموذج في Apidog قبل تحويل حركة المرور الإنتاجية.
GPT-6 Sol مقابل GPT-6.1 Sol: ما الذي تغير في واجهة برمجة التطبيقات؟
معظم المواصفات متطابقة. يوضح الجدول التالي الفروقات بين صفحة نموذج GPT-6.1 Sol، وصفحة نموذج GPT-6 Sol، وإرشادات الترحيل إلى GPT-6 من OpenAI:
| البند | gpt-6-sol |
gpt-6.1-sol |
الإجراء المطلوب |
|---|---|---|---|
| المدخل / المخرج لكل مليون رمز مميز، قياسي | $2 / $10 | $2 / $10 | لا شيء |
| المدخل المخزن مؤقتًا لكل مليون | $0.20 | $0.10 | أعد حسابات التخزين المؤقت |
| كتابات التخزين المؤقت لكل مليون | $2.50 | $2.50 | لا شيء |
| نافذة السياق / أقصى مدخل / أقصى مخرج | 1,050,000 / 922,000 / 128,000 | 1,050,000 / 922,000 / 128,000 | لا شيء |
| تاريخ قطع المعرفة | 20 أبريل 2026 | 30 أبريل 2026 | أعد فحص التقييمات الحساسة للتواريخ |
reasoning.effort |
none، low، medium، high، xhigh، max
|
low، medium، high، xhigh، max
|
انقل none إلى low وأعد التقييم |
| استدعاء الدوال في Chat Completions | فقط مع reasoning_effort: "none"
|
غير مدعوم | انقل استدعاءات الأدوات إلى Responses |
| نقاط النهاية | Chat Completions، Responses، Batch | نفسها | لا شيء |
| حدود المعدل | المستوى 1: 500 RPM / 500 ألف TPM؛ المستوى 5: 15,000 RPM / 40 مليون TPM | نفسها | لا شيء |
توجه صفحة GPT-6 Sol الآن القراء إلى GPT-6.1 Sol باعتباره «نموذج Sol الأحدث».
أرسل طلبك الأول إلى GPT-6.1 Sol
- صدّر مفتاح API في متغير البيئة
OPENAI_API_KEY. - استدعِ واجهة برمجة تطبيقات Responses.
- ابدأ بمستوى جهد
medium، ثم قارن التكلفة والجودة قبل تغييره.
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "List three ways a webhook retry policy can create duplicate orders. One line each."
}'
تقرأ حزمة Python SDK متغير البيئة نفسه:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "medium"},
input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)
print(response.output_text)
print(response.usage)
عند معالجة الاستجابة، تحقق من هذه الأجزاء:
-
status: يكونcompletedعند النجاح. إذا استنفد النموذج ميزانية الإخراج، قد تحصل علىincompleteمعincomplete_details.reason: "max_output_tokens"، أحيانًا قبل أي نص مرئي. يقترح دليل الاستدلال حجز 25,000 رمز مميز على الأقل للاستدلال والإخراج أثناء التجربة. -
output: مصفوفة، والإجابة هي العنصر الذي يحملtype: "message"ويتضمن محتوى من النوعoutput_text. اقرأه حسب النوع بدلًا من الاعتماد على فهرس ثابت. -
usage.output_tokens: يتضمن رموز الاستدلال، وتُحاسب بسعر رموز الإخراج. راجعusage.output_tokens_details.reasoning_tokensلمعرفة عددها. -
usage.input_tokens_details: يعرضcached_tokensوcache_write_tokens، وهنا يظهر أثر التخزين المؤقت الأقل تكلفة.
استخدم واجهة Responses لأي طلب يتضمن أدوات. يدعم GPT-6.1 Sol Chat Completions للطلبات التي لا تتضمن أدوات فقط. يشرح دليل واجهة Responses API شكل الطلب بمزيد من التفصيل.
اختر مستوى جهد الاستدلال
الجهد هو مقياسك الأساسي للموازنة بين التكلفة والجودة. القيمة الافتراضية هي medium عند عدم تحديدها.
يربط دليل اختيار النماذج من OpenAI مستوى medium بالأعمال الفنية المعقدة والمخرجات المنسقة التي ستراجعها، ويربط xhigh بالنتائج النهائية عالية الجودة والقرارات التي تتضمن أدلة متضاربة. يضيف منشور إطلاق OpenAI نتائج حسب الإعداد:
| الجهد | ابدأ به من أجل | ما أبلغت عنه OpenAI لـ GPT-6.1 Sol |
|---|---|---|
low |
الدردشة، الاستخراج، التصنيف، وأي حمل كان يستخدم none
|
في محادثات أبلغ عنها المستخدمون لوجود أخطاء واقعية، انخفضت الاستجابات التي تحتوي على خطأ واقعي من 11.4% في GPT-6 Sol إلى 7.7% |
medium |
أتمتة الوكلاء وسير عمل استدعاء الأدوات | AutomationBench 1.0.6: +2.2 نقطة مئوية فوق Claude Opus 5.5 بتكلفة تقارب الثلث، و+4.8 نقطة مئوية فوق GPT-6 Sol بالإعداد نفسه |
high |
تصحيح الأخطاء الصعبة والتخطيط العميق | لا يوجد ادعاء خاص بالإعداد |
xhigh |
مخرجات نهائية مصقولة وعمليات غير متزامنة طويلة | لا يوجد ادعاء خاص بالإعداد |
max |
استخدام الكمبيوتر ومهام العلوم الصعبة | OSWorld 2.0: +7 نقاط مئوية فوق GPT-6 Sol عند الحد الأقصى بأقل من نصف التكلفة. Terminal-Bench Science 0.1: 5.47 دولار لكل مهمة، مقابل 23.21 دولار لـ Opus 5.5 و23.80 دولار لـ GPT-6 Astra |
انتبه إلى نقطتين:
- مجموعة الحقائق المذكورة هي محادثات أبلغ عنها مسبقًا لوجود أخطاء فيها، وليست حركة مرور عادية.
- في Terminal-Bench Science، لا يزال GPT-6 Astra يحقق أعلى نتيجة، 68.1%، لذا توصي OpenAI بـ Astra للأعمال العلمية الأكثر صعوبة.
إذا كنت تستخدم none في طلبات حساسة للتأخير، فابدأ بـ low وقِس النتائج. يصف دليل الاستدلال low بأنه استدلال فعال مع زيادة متواضعة في التأخير.
لتغيير الجهد أثناء محادثة دون كسر ذاكرة التخزين المؤقت للموجه، أضف عنصر إدخال configuration_update بدلًا من تغيير reasoning.effort على مستوى الطلب.
الترحيل من gpt-6-sol: أربعة تغييرات في التعليمات البرمجية
استبدل معرّف النموذج
استبدلgpt-6-solبـgpt-6.1-sol. احتفظ بالمعرّف في ملف إعدادات أو متغير بيئة لتسهيل التراجع بتعديل واحد.أعد تعيين
noneوminimal
استخدمlowبدلًا منnone. بالنسبة إلىminimal، ابدأ منlowوقارن النتائج على مهام تمثيلية. في GPT-6 Astra، الذي لا يدعمnoneأيضًا، يؤدي إرسالها إلى HTTP 400، لذا أصلح هذا المسار قبل تحويل حركة المرور.أزل معاملات أخذ العينات
عندما لا يكون الجهدnone، أزلtemperatureوtop_pوtop_logprobs، وأزلlogprobsفي Chat Completions. تحتاج التعليمات البرمجية التي كانت تجمعtemperatureمعnoneفي GPT-6 Sol إلى هذا التغيير.انقل استدعاءات أدوات Chat Completions إلى Responses
كان GPT-6 Sol يسمح باستدعاء الدوال في Chat Completions فقط معreasoning_effort: "none". لا يوجد مكافئ لهذا المزيج في GPT-6.1 Sol.
بعد ذلك، أعد تشغيل التقييمات التي تعتمد على حداثة المعرفة، لأن تاريخ القطع ينتقل من 20 أبريل إلى 30 أبريل 2026. إذا انتقلت إلى Sol من Astra، فراجع دليل الترحيل من Astra إلى Sol.
تسعير Batch وFlex وFast والمدخلات المخزنة مؤقتًا
تحافظ كل طبقة على شكل تسعير GPT-6 Sol، مع خفض سعر المدخلات المخزنة مؤقتًا إلى النصف. الأسعار التالية لكل مليون رمز مميز مأخوذة من صفحة تسعير API.
تضيف صفحة النموذج أن الموجه الذي يزيد على 272 ألف رمز إدخال يُحاسب بضعف سعر الإدخال والتخزين المؤقت، و1.5 ضعف سعر الإخراج للطلب الكامل، وهي القاعدة نفسها المستخدمة مع GPT-6 Sol.
| الطبقة | المدخل | المدخل المخزن مؤقتًا | كتابات التخزين المؤقت | المخرج |
|---|---|---|---|---|
| قياسي | $2.00 | $0.10 | $2.50 | $10.00 |
| دفعة | $1.00 | $0.05 | $1.25 | $5.00 |
| مرن | $1.00 | $0.05 | $1.25 | $5.00 |
| سريع | $4.00 | $0.20 | $5.00 | $20.00 |
| قياسي، موجه أكبر من 272 ألف رمز إدخال | $4.00 | $0.20 | $5.00 | $15.00 |
استخدم هذه القيم في الطلب:
- Flex:
service_tier: "flex" - Fast:
service_tier: "fast"، ويُقبل"priority"كاسم مستعار.
الوضع السريع غير متاح مع إقامة البيانات في الاتحاد الأوروبي. وضع Ultrafast لـ GPT-6.1 Sol «قادم قريبًا»، وهو متاح على نطاق واسع لـ GPT-6 Astra حاليًا. راجع وضع OpenAI فائق السرعة.
بالنسبة للمهام الليلية، يشرح دليل OpenAI Batch API تشغيل دفعة.
احسب وفر التخزين المؤقت
التخزين المؤقت هو موضع التوفير الأساسي في هذا التحديث:
- قراءة ذاكرة التخزين المؤقت في GPT-6.1 Sol تكلف
0.05xمن سعر الإدخال. - القراءة في GPT-6 Sol تكلف
0.1xمن سعر الإدخال. - كتابة ذاكرة التخزين المؤقت تكلف
1.25xمن سعر الإدخال في النموذجين.
وفقًا لـ دليل التخزين المؤقت للموجهات، إذا كان لديك موجه نظام من 50,000 رمز يُعاد استخدامه عبر 1,000 طلب:
- تكلفة كتابة واحدة: 0.125 دولار على أي من النموذجين.
- تكلفة 999 قراءة: 9.99 دولار على GPT-6 Sol.
- تكلفة 999 قراءة: 5.00 دولارات على GPT-6.1 Sol.
الحد الأدنى للبادئة القابلة للتخزين المؤقت هو 1,024 رمزًا مرئيًا. تبقى البادئة المخزنة مؤقتًا مؤهلة لمدة 30 دقيقة على الأقل بعد آخر كتابة أو إعادة استخدام. لاستراتيجية نقاط التوقف، راجع التخزين المؤقت للموجه في GPT-6.
اختبر التبديل في Apidog
لا تحوّل الإنتاج اعتمادًا على الأسعار المعلنة فقط. أرسل الطلب المحفوظ نفسه إلى كلا المعرّفين وقارن المخرجات والتكلفة.
في Apidog، نفّذ الخطوات التالية:
-
أنشئ بيئة تحتوي على:
-
OPENAI_API_KEYكمفتاح سري. -
MODEL_IDبقيمةgpt-6-sol. -
EFFORTبقيمةmedium.
-
أنشئ طلبًا إلى
POST https://api.openai.com/v1/responsesمع الترويسة التالية:
Authorization: Bearer {{OPENAI_API_KEY}}
ثم استخدم هذا النص واحفظ الطلب:
{
"model": "{{MODEL_ID}}",
"reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000,
"input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
-
أضف تأكيدات للتحقق من:
- HTTP 200.
- أن
$.statusيساويcompleted. - أن
$.output[*].typeيحتوي علىmessage. - أن
$.usage.output_tokensأكبر من 0. - وجود
$.usage.output_tokens_details.reasoning_tokens. - صحة شكل الإخراج الذي تعتمد عليه تطبيقاتك، مثل JSON صالح بالمفاتيح التي تحللها.
أضف برنامج معالجة لاحقة لحساب التكلفة من
usage:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");
const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;
const cost = (
(u.input_tokens - cached - writes) * 2 +
cached * cachedRate +
writes * 2.5 +
u.output_tokens * 10
) / 1e6;
console.log(model, "cost per call $", cost.toFixed(5));
- شغّل الطلب مع
MODEL_ID=gpt-6-sol، ثم غيّر القيمة إلىgpt-6.1-solوشغّله مجددًا. قارن:reasoning_tokensoutput_tokens- نص الإجابة
- التكلفة المسجلة
إذا كنت تعيد تعيين none، شغّل الأساس بـ none والمرشح بـ low.
بعد ذلك، انقل الطلب وعدة موجهات حقيقية إلى سيناريو اختبار وشغّل الزوج من Apidog CLI في CI. يتجاوز --env-var متغير البيئة لتشغيل واحد، لذا يمكن للسيناريو نفسه تغطية النموذجين:
npm install -g apidog-cli
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6-sol" -r cli,junit
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6.1-sol" -r cli,junit
فشل أي تأكيد يؤدي إلى فشل المهمة، وتعرض تقارير JUnit عمليتي التشغيل جنبًا إلى جنب. للتأكيدات على مخرجات تتغير بين التشغيلات، راجع اختبار وكلاء الذكاء الاصطناعي غير الحتميين.
الأسئلة الشائعة
هل GPT-6.1 Sol أغلى من GPT-6 Sol؟
لا. كلاهما بسعر 2 دولار للمدخلات و10 دولارات للمخرجات لكل مليون رمز مميز. المدخلات المخزنة مؤقتًا في GPT-6.1 Sol تكلف 0.10 دولار مقابل 0.20 دولار، لذا تصبح أعباء العمل التي تعتمد بكثرة على التخزين المؤقت أرخص.ماذا أفعل بـ
reasoning.effort: "none"؟
لا يدعم GPT-6.1 Sol القيمتينnoneوminimal. عيّن كليهما إلىlow، وأزلtemperatureوtop_p، ثم أعد تشغيل تقييماتك قبل التبديل.هل يمكنني استخدام GPT-6.1 Sol مع Chat Completions؟
نعم، للطلبات التي لا تحتوي على أدوات. استدعاء الأدوات يتطلب واجهة Responses.هل توجد طبقة مجانية لواجهة GPT-6.1 Sol API؟
لا. تُحسب تكلفة الاستدعاءات لكل رمز مميز بدءًا من الطلب الأول. يغطي هل GPT-6.1 Sol مجاني؟ الخيارات الأقل تكلفة.
الخطوة التالية
احفظ طلبك الأول، وشغّله على gpt-6-sol بمستوى جهدك الحالي، ثم على gpt-6.1-sol. قارن usage والمخرجات باستخدام موجه من حركة المرور الحقيقية لديك.
نزّل Apidog للاحتفاظ بكلا التشغيلين كتأكيدات قابلة لإعادة التشغيل في CI. إذا كنت تقارن مع Anthropic، راجع GPT-6.1 Sol مقابل Claude Sonnet 5.5.
Top comments (0)