DEV Community

Cover image for كيف تستخدم GPT-6.1 Sol API؟
Yusuf Khalidd
Yusuf Khalidd

Posted on Originally published at apidog.com

كيف تستخدم GPT-6.1 Sol API؟

لاستدعاء واجهة برمجة تطبيقات GPT-6.1 Sol، أرسل طلب POST إلى https://api.openai.com/v1/responses مع "model": "gpt-6.1-sol" ومفتاحك كرمز Bearer. يُسعّر بنفس سعر GPT-6 Sol: 2 دولار للمدخلات و10 دولارات للمخرجات لكل مليون رمز مميز، بينما ينخفض سعر المدخلات المخزنة مؤقتًا من 0.20 دولار إلى 0.10 دولار. الترحيل من gpt-6-sol هو غالبًا تبديل معرّف النموذج، لكن التغيير الجوهري هو مستوى الجهد: لا يقبل GPT-6.1 Sol القيمتين none أو minimal، لذا يجب نقل هذه الطلبات إلى low.

جرّب Apidog اليوم

أطلقت OpenAI نموذج GPT-6.1 Sol في DevDay بتاريخ 29 سبتمبر 2026. يغطي ملخص DevDay 2026 الإطلاقات الأخرى، بينما يشرح ما هو GPT-6.1 Sol المعايير بمزيد من التفصيل. يركز هذا الدليل على تنفيذ أول طلب، واختيار مستوى الجهد، وخطوات الترحيل، وتسعير Batch وFlex وFast، ثم تشغيل اختبار تراجع متوازٍ لكلا معرّفي النموذج في Apidog قبل تحويل حركة المرور الإنتاجية.

GPT-6 Sol مقابل GPT-6.1 Sol: ما الذي تغير في واجهة برمجة التطبيقات؟

معظم المواصفات متطابقة. يوضح الجدول التالي الفروقات بين صفحة نموذج GPT-6.1 Sol، وصفحة نموذج GPT-6 Sol، وإرشادات الترحيل إلى GPT-6 من OpenAI:

البند gpt-6-sol gpt-6.1-sol الإجراء المطلوب
المدخل / المخرج لكل مليون رمز مميز، قياسي $2 / $10 $2 / $10 لا شيء
المدخل المخزن مؤقتًا لكل مليون $0.20 $0.10 أعد حسابات التخزين المؤقت
كتابات التخزين المؤقت لكل مليون $2.50 $2.50 لا شيء
نافذة السياق / أقصى مدخل / أقصى مخرج 1,050,000 / 922,000 / 128,000 1,050,000 / 922,000 / 128,000 لا شيء
تاريخ قطع المعرفة 20 أبريل 2026 30 أبريل 2026 أعد فحص التقييمات الحساسة للتواريخ
reasoning.effort none، low، medium، high، xhigh، max low، medium، high، xhigh، max انقل none إلى low وأعد التقييم
استدعاء الدوال في Chat Completions فقط مع reasoning_effort: "none" غير مدعوم انقل استدعاءات الأدوات إلى Responses
نقاط النهاية Chat Completions، Responses، Batch نفسها لا شيء
حدود المعدل المستوى 1: 500 RPM / 500 ألف TPM؛ المستوى 5: 15,000 RPM / 40 مليون TPM نفسها لا شيء

توجه صفحة GPT-6 Sol الآن القراء إلى GPT-6.1 Sol باعتباره «نموذج Sol الأحدث».

أرسل طلبك الأول إلى GPT-6.1 Sol

  1. صدّر مفتاح API في متغير البيئة OPENAI_API_KEY.
  2. استدعِ واجهة برمجة تطبيقات Responses.
  3. ابدأ بمستوى جهد medium، ثم قارن التكلفة والجودة قبل تغييره.
curl https://api.openai.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "medium"},
    "input": "List three ways a webhook retry policy can create duplicate orders. One line each."
  }'
Enter fullscreen mode Exit fullscreen mode

تقرأ حزمة Python SDK متغير البيئة نفسه:

from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-6.1-sol",
    reasoning={"effort": "medium"},
    input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)

print(response.output_text)
print(response.usage)
Enter fullscreen mode Exit fullscreen mode

عند معالجة الاستجابة، تحقق من هذه الأجزاء:

  • status: يكون completed عند النجاح. إذا استنفد النموذج ميزانية الإخراج، قد تحصل على incomplete مع incomplete_details.reason: "max_output_tokens"، أحيانًا قبل أي نص مرئي. يقترح دليل الاستدلال حجز 25,000 رمز مميز على الأقل للاستدلال والإخراج أثناء التجربة.
  • output: مصفوفة، والإجابة هي العنصر الذي يحمل type: "message" ويتضمن محتوى من النوع output_text. اقرأه حسب النوع بدلًا من الاعتماد على فهرس ثابت.
  • usage.output_tokens: يتضمن رموز الاستدلال، وتُحاسب بسعر رموز الإخراج. راجع usage.output_tokens_details.reasoning_tokens لمعرفة عددها.
  • usage.input_tokens_details: يعرض cached_tokens وcache_write_tokens، وهنا يظهر أثر التخزين المؤقت الأقل تكلفة.

استخدم واجهة Responses لأي طلب يتضمن أدوات. يدعم GPT-6.1 Sol Chat Completions للطلبات التي لا تتضمن أدوات فقط. يشرح دليل واجهة Responses API شكل الطلب بمزيد من التفصيل.

اختر مستوى جهد الاستدلال

الجهد هو مقياسك الأساسي للموازنة بين التكلفة والجودة. القيمة الافتراضية هي medium عند عدم تحديدها.

يربط دليل اختيار النماذج من OpenAI مستوى medium بالأعمال الفنية المعقدة والمخرجات المنسقة التي ستراجعها، ويربط xhigh بالنتائج النهائية عالية الجودة والقرارات التي تتضمن أدلة متضاربة. يضيف منشور إطلاق OpenAI نتائج حسب الإعداد:

الجهد ابدأ به من أجل ما أبلغت عنه OpenAI لـ GPT-6.1 Sol
low الدردشة، الاستخراج، التصنيف، وأي حمل كان يستخدم none في محادثات أبلغ عنها المستخدمون لوجود أخطاء واقعية، انخفضت الاستجابات التي تحتوي على خطأ واقعي من 11.4% في GPT-6 Sol إلى 7.7%
medium أتمتة الوكلاء وسير عمل استدعاء الأدوات AutomationBench 1.0.6: +2.2 نقطة مئوية فوق Claude Opus 5.5 بتكلفة تقارب الثلث، و+4.8 نقطة مئوية فوق GPT-6 Sol بالإعداد نفسه
high تصحيح الأخطاء الصعبة والتخطيط العميق لا يوجد ادعاء خاص بالإعداد
xhigh مخرجات نهائية مصقولة وعمليات غير متزامنة طويلة لا يوجد ادعاء خاص بالإعداد
max استخدام الكمبيوتر ومهام العلوم الصعبة OSWorld 2.0: +7 نقاط مئوية فوق GPT-6 Sol عند الحد الأقصى بأقل من نصف التكلفة. Terminal-Bench Science 0.1: 5.47 دولار لكل مهمة، مقابل 23.21 دولار لـ Opus 5.5 و23.80 دولار لـ GPT-6 Astra

انتبه إلى نقطتين:

  1. مجموعة الحقائق المذكورة هي محادثات أبلغ عنها مسبقًا لوجود أخطاء فيها، وليست حركة مرور عادية.
  2. في Terminal-Bench Science، لا يزال GPT-6 Astra يحقق أعلى نتيجة، 68.1%، لذا توصي OpenAI بـ Astra للأعمال العلمية الأكثر صعوبة.

إذا كنت تستخدم none في طلبات حساسة للتأخير، فابدأ بـ low وقِس النتائج. يصف دليل الاستدلال low بأنه استدلال فعال مع زيادة متواضعة في التأخير.

لتغيير الجهد أثناء محادثة دون كسر ذاكرة التخزين المؤقت للموجه، أضف عنصر إدخال configuration_update بدلًا من تغيير reasoning.effort على مستوى الطلب.

الترحيل من gpt-6-sol: أربعة تغييرات في التعليمات البرمجية

  1. استبدل معرّف النموذج

    استبدل gpt-6-sol بـ gpt-6.1-sol. احتفظ بالمعرّف في ملف إعدادات أو متغير بيئة لتسهيل التراجع بتعديل واحد.

  2. أعد تعيين none وminimal

    استخدم low بدلًا من none. بالنسبة إلى minimal، ابدأ من low وقارن النتائج على مهام تمثيلية. في GPT-6 Astra، الذي لا يدعم none أيضًا، يؤدي إرسالها إلى HTTP 400، لذا أصلح هذا المسار قبل تحويل حركة المرور.

  3. أزل معاملات أخذ العينات

    عندما لا يكون الجهد none، أزل temperature وtop_p وtop_logprobs، وأزل logprobs في Chat Completions. تحتاج التعليمات البرمجية التي كانت تجمع temperature مع none في GPT-6 Sol إلى هذا التغيير.

  4. انقل استدعاءات أدوات Chat Completions إلى Responses

    كان GPT-6 Sol يسمح باستدعاء الدوال في Chat Completions فقط مع reasoning_effort: "none". لا يوجد مكافئ لهذا المزيج في GPT-6.1 Sol.

بعد ذلك، أعد تشغيل التقييمات التي تعتمد على حداثة المعرفة، لأن تاريخ القطع ينتقل من 20 أبريل إلى 30 أبريل 2026. إذا انتقلت إلى Sol من Astra، فراجع دليل الترحيل من Astra إلى Sol.

تسعير Batch وFlex وFast والمدخلات المخزنة مؤقتًا

تحافظ كل طبقة على شكل تسعير GPT-6 Sol، مع خفض سعر المدخلات المخزنة مؤقتًا إلى النصف. الأسعار التالية لكل مليون رمز مميز مأخوذة من صفحة تسعير API.

تضيف صفحة النموذج أن الموجه الذي يزيد على 272 ألف رمز إدخال يُحاسب بضعف سعر الإدخال والتخزين المؤقت، و1.5 ضعف سعر الإخراج للطلب الكامل، وهي القاعدة نفسها المستخدمة مع GPT-6 Sol.

الطبقة المدخل المدخل المخزن مؤقتًا كتابات التخزين المؤقت المخرج
قياسي $2.00 $0.10 $2.50 $10.00
دفعة $1.00 $0.05 $1.25 $5.00
مرن $1.00 $0.05 $1.25 $5.00
سريع $4.00 $0.20 $5.00 $20.00
قياسي، موجه أكبر من 272 ألف رمز إدخال $4.00 $0.20 $5.00 $15.00

استخدم هذه القيم في الطلب:

  • Flex: service_tier: "flex"
  • Fast: service_tier: "fast"، ويُقبل "priority" كاسم مستعار.

الوضع السريع غير متاح مع إقامة البيانات في الاتحاد الأوروبي. وضع Ultrafast لـ GPT-6.1 Sol «قادم قريبًا»، وهو متاح على نطاق واسع لـ GPT-6 Astra حاليًا. راجع وضع OpenAI فائق السرعة.

بالنسبة للمهام الليلية، يشرح دليل OpenAI Batch API تشغيل دفعة.

احسب وفر التخزين المؤقت

التخزين المؤقت هو موضع التوفير الأساسي في هذا التحديث:

  • قراءة ذاكرة التخزين المؤقت في GPT-6.1 Sol تكلف 0.05x من سعر الإدخال.
  • القراءة في GPT-6 Sol تكلف 0.1x من سعر الإدخال.
  • كتابة ذاكرة التخزين المؤقت تكلف 1.25x من سعر الإدخال في النموذجين.

وفقًا لـ دليل التخزين المؤقت للموجهات، إذا كان لديك موجه نظام من 50,000 رمز يُعاد استخدامه عبر 1,000 طلب:

  • تكلفة كتابة واحدة: 0.125 دولار على أي من النموذجين.
  • تكلفة 999 قراءة: 9.99 دولار على GPT-6 Sol.
  • تكلفة 999 قراءة: 5.00 دولارات على GPT-6.1 Sol.

الحد الأدنى للبادئة القابلة للتخزين المؤقت هو 1,024 رمزًا مرئيًا. تبقى البادئة المخزنة مؤقتًا مؤهلة لمدة 30 دقيقة على الأقل بعد آخر كتابة أو إعادة استخدام. لاستراتيجية نقاط التوقف، راجع التخزين المؤقت للموجه في GPT-6.

اختبر التبديل في Apidog

لا تحوّل الإنتاج اعتمادًا على الأسعار المعلنة فقط. أرسل الطلب المحفوظ نفسه إلى كلا المعرّفين وقارن المخرجات والتكلفة.

في Apidog، نفّذ الخطوات التالية:

  1. أنشئ بيئة تحتوي على:

    • OPENAI_API_KEY كمفتاح سري.
    • MODEL_ID بقيمة gpt-6-sol.
    • EFFORT بقيمة medium.
  2. أنشئ طلبًا إلى POST https://api.openai.com/v1/responses مع الترويسة التالية:

   Authorization: Bearer {{OPENAI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode

ثم استخدم هذا النص واحفظ الطلب:

   {
     "model": "{{MODEL_ID}}",
     "reasoning": {"effort": "{{EFFORT}}"},
     "max_output_tokens": 25000,
     "input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
   }
Enter fullscreen mode Exit fullscreen mode
  1. أضف تأكيدات للتحقق من:

    • HTTP 200.
    • أن $.status يساوي completed.
    • أن $.output[*].type يحتوي على message.
    • أن $.usage.output_tokens أكبر من 0.
    • وجود $.usage.output_tokens_details.reasoning_tokens.
    • صحة شكل الإخراج الذي تعتمد عليه تطبيقاتك، مثل JSON صالح بالمفاتيح التي تحللها.
  2. أضف برنامج معالجة لاحقة لحساب التكلفة من usage:

   const u = pm.response.json().usage;
   const d = u.input_tokens_details || {};
   const cached = d.cached_tokens || 0;
   const writes = d.cache_write_tokens || 0;
   const model = pm.environment.get("MODEL_ID");

   const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;

   const cost = (
     (u.input_tokens - cached - writes) * 2 +
     cached * cachedRate +
     writes * 2.5 +
     u.output_tokens * 10
   ) / 1e6;

   console.log(model, "cost per call $", cost.toFixed(5));
Enter fullscreen mode Exit fullscreen mode
  1. شغّل الطلب مع MODEL_ID=gpt-6-sol، ثم غيّر القيمة إلى gpt-6.1-sol وشغّله مجددًا. قارن:
    • reasoning_tokens
    • output_tokens
    • نص الإجابة
    • التكلفة المسجلة

إذا كنت تعيد تعيين none، شغّل الأساس بـ none والمرشح بـ low.

بعد ذلك، انقل الطلب وعدة موجهات حقيقية إلى سيناريو اختبار وشغّل الزوج من Apidog CLI في CI. يتجاوز --env-var متغير البيئة لتشغيل واحد، لذا يمكن للسيناريو نفسه تغطية النموذجين:

npm install -g apidog-cli

apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6-sol" -r cli,junit

apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6.1-sol" -r cli,junit
Enter fullscreen mode Exit fullscreen mode

فشل أي تأكيد يؤدي إلى فشل المهمة، وتعرض تقارير JUnit عمليتي التشغيل جنبًا إلى جنب. للتأكيدات على مخرجات تتغير بين التشغيلات، راجع اختبار وكلاء الذكاء الاصطناعي غير الحتميين.

الأسئلة الشائعة

  • هل GPT-6.1 Sol أغلى من GPT-6 Sol؟

    لا. كلاهما بسعر 2 دولار للمدخلات و10 دولارات للمخرجات لكل مليون رمز مميز. المدخلات المخزنة مؤقتًا في GPT-6.1 Sol تكلف 0.10 دولار مقابل 0.20 دولار، لذا تصبح أعباء العمل التي تعتمد بكثرة على التخزين المؤقت أرخص.

  • ماذا أفعل بـ reasoning.effort: "none"؟

    لا يدعم GPT-6.1 Sol القيمتين none وminimal. عيّن كليهما إلى low، وأزل temperature وtop_p، ثم أعد تشغيل تقييماتك قبل التبديل.

  • هل يمكنني استخدام GPT-6.1 Sol مع Chat Completions؟

    نعم، للطلبات التي لا تحتوي على أدوات. استدعاء الأدوات يتطلب واجهة Responses.

  • هل توجد طبقة مجانية لواجهة GPT-6.1 Sol API؟

    لا. تُحسب تكلفة الاستدعاءات لكل رمز مميز بدءًا من الطلب الأول. يغطي هل GPT-6.1 Sol مجاني؟ الخيارات الأقل تكلفة.

الخطوة التالية

احفظ طلبك الأول، وشغّله على gpt-6-sol بمستوى جهدك الحالي، ثم على gpt-6.1-sol. قارن usage والمخرجات باستخدام موجه من حركة المرور الحقيقية لديك.

نزّل Apidog للاحتفاظ بكلا التشغيلين كتأكيدات قابلة لإعادة التشغيل في CI. إذا كنت تقارن مع Anthropic، راجع GPT-6.1 Sol مقابل Claude Sonnet 5.5.

Top comments (0)