OpenAI Ultrafast هي طبقة خدمة، وليست نموذجًا جديدًا. أضف service_tier: "ultrafast" إلى طلب واجهة برمجة تطبيقات Responses لـ gpt-6-astra لتوليد الرموز المميزة أسرع بما يصل إلى 6 مرات عبر واجهة البرمجة (ويصل ذلك إلى 8 مرات، أو 300 رمز مميز في الثانية، في Codex). تكلفتها تعادل 6 أضعاف Standard: 60 دولارًا للمدخلات و300 دولار للمخرجات لكل مليون رمز مميز، مقابل 10 دولارات و50 دولارًا. لا يتغير معرف النموذج، لذلك تصبح الإجابات أسرع لا أذكى. استخدمها عندما ينتظر مستخدم أو مسار حساس للكمون مخرجات طويلة، وليس عادةً للمهام الدفعية أو الخلفية.
أتاحت OpenAI خدمة Ultrafast على نطاق واسع لنموذج GPT-6 Astra في DevDay بتاريخ 29 سبتمبر 2026. راجع كل ما تبقى من DevDay. يغطي هذا الدليل التوافر، وإرسال الطلبات، والأسعار، وحدود المعدل، وطريقة حساب التعادل بأرقامك الفعلية. ولتفاصيل النموذج نفسه، اقرأ دليل واجهة برمجة تطبيقات GPT-6 Astra. قبل التبديل، قِس الطبقتين باستخدام Apidog.
نظرة عامة على OpenAI Ultrafast
| البند | التفاصيل |
|---|---|
| ما هو | أسرع طبقة خدمة في واجهة برمجة تطبيقات OpenAI |
| المعلمة |
service_tier: "ultrafast" عند إنشاء استجابات create أو response.create عبر WebSocket |
| النماذج | GPT-6 Astra اليوم؛ GPT-6.1 Sol «قريبًا» |
| ادعاء السرعة | توليد رمز مميز أسرع بما يصل إلى 6 مرات في واجهة البرمجة؛ ويصل إلى 8 مرات (300 رمز مميز/ثانية) في Codex |
| السعر (Astra) | 60 دولارًا للمدخلات، و6 دولارات للمدخلات المخزنة مؤقتًا، و75 دولارًا لكتابة ذاكرة التخزين المؤقت، و300 دولار للمخرجات لكل مليون رمز مميز |
| حدود المعدل | 500 ألف رمز مميز في الدقيقة (الطبقات 1–3)، ومليون (الطبقة 4)، و5 ملايين (الطبقة 5) |
| المعالجة | موقع البيانات في الولايات المتحدة والمعالجة العالمية فقط؛ لا توجد نقاط نهاية في الاتحاد الأوروبي أو مناطق أخرى |
| النقل | يوصى بشدة باستخدام WebSockets |
| خطط ChatGPT | ChatGPT Work وCodex على Pro 500 وEnterprise |
المصادر: دليل وضع Ultrafast وصفحة التسعير من OpenAI.
ما هو Ultrafast، ومن يمكنه استخدامه
تشير OpenAI إلى Ultrafast كطبقة سرعة متميزة. وفقًا للدليل، تتوفر GPT-6 Astra Ultrafast لجميع مستخدمي واجهة البرمجة بحدود معدل افتراضية منخفضة، ويمكن للمؤسسات التي لديها فريق حساب OpenAI طلب حدود أعلى.
يسرد الدليل أيضًا وصولًا مبكرًا لـ GPT-5.6 Sol عبر فرق الحساب، وكانت OpenAI قد عرضت Ultrafast لأول مرة على GPT-5.6 Sol في 13 أغسطس. يشير الملخص إلى GPT-6.1 Sol باعتباره النموذج التالي. لم يُنشر سعر Ultrafast لأي منهما.
في ChatGPT، تعمل Ultrafast Astra في ChatGPT Work وCodex على Pro 500 وEnterprise. هذا الاشتراك يخص التطبيقات، وليس واجهة البرمجة: ستظل النصوص البرمجية، ومهام التكامل المستمر (CI)، والوكلاء الذين تبنيهم تدفع مقابل كل رمز مميز باستخدام مفتاح API.
اقرأ ادعاء السرعة بدقة:
- يتعلق بتوليد الرموز المميزة ويستخدم عبارة «يصل إلى».
- رقم 300 رمز مميز في الثانية خاص بـ Codex.
- ادعاء واجهة البرمجة يصل إلى 6 أضعاف.
- لا تنشر OpenAI رقمًا لوقت الوصول إلى أول رمز مميز (TTFT) في Ultrafast.
- لا يخبرك معدل الرموز في الثانية بمدة الانتظار قبل ظهور أول رمز مميز.
كيفية تمكين service_tier: "ultrafast"
اضبط model على gpt-6-astra وservice_tier على ultrafast في كل طلب.
طلب HTTP
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Explain why the sky is blue in one sentence.",
"service_tier": "ultrafast"
}'
البث عبر WebSocket
توصي OpenAI بشدة باستخدام WebSockets، خصوصًا للوكلاء الذين ينفذون استدعاءات أدوات كثيرة ومتتابعة. السبب: يمكن أن يستهلك حمل الشبكة لكل طلب جزءًا مهمًا من مكاسب السرعة.
يوضح المثال التالي دورتين عبر اتصال واحد:
from openai import OpenAI
client = OpenAI()
previous_response_id: str | None = None
prompts = [
"Explain why the sky is blue in one sentence.",
"Now explain why sunsets look red.",
]
with client.responses.connect() as connection:
for prompt in prompts:
connection.response.create(
model="gpt-6-astra",
service_tier="ultrafast",
previous_response_id=previous_response_id,
input=prompt,
)
for event in connection:
if event.type == "response.output_text.delta":
print(event.delta, end="", flush=True)
elif event.type == "response.completed":
previous_response_id = event.response.id
print()
break
elif event.type in {"response.failed", "response.incomplete", "error"}:
raise RuntimeError(event.to_json())
else:
raise RuntimeError("Connection closed before the response finished.")
ثبّت الحزمة واضبط متغير البيئة:
pip install --upgrade "openai[realtime]"
export OPENAI_API_KEY="your-api-key"
يغطي دليل وضع OpenAI WebSocket حدود الاتصال وإعادة الاتصال.
تسعير Ultrafast بجانب Standard وFast وBatch
الأسعار التالية لكل مليون رمز مميز لـ gpt-6-astra ضمن سياق قصير، أي 272 ألف رمز مميز للمدخلات أو أقل:
| الطبقة | المدخلات | المدخلات المخزنة مؤقتًا | كتابة ذاكرة التخزين المؤقت | المخرجات | مقارنة بـ Standard |
|---|---|---|---|---|---|
| Standard | $10.00 | $1.00 | $12.50 | $50.00 | 1x |
| Batch أو Flex | $5.00 | $0.50 | $6.25 | $25.00 | 0.5x |
| Fast | $20.00 | $2.00 | $25.00 | $100.00 | 2x |
| Ultrafast | $60.00 | $6.00 | $75.00 | $300.00 | 6x |
فوق 272 ألف رمز مميز للمدخلات، ترتفع تكلفة Ultrafast إلى:
- 120 دولارًا للمدخلات
- 12 دولارًا للمدخلات المخزنة مؤقتًا
- 150 دولارًا لكتابة ذاكرة التخزين المؤقت
- 450 دولارًا للمخرجات
Fast هي المعالجة ذات الأولوية السابقة، وقد أُعيدت تسميتها في 30 يوليو 2026. لاحظ أن مضاعف السعر يشمل أعمدة المدخلات أيضًا؛ لذلك تدفع 6 أضعاف على المطالبات الطويلة رغم أن ادعاء السرعة يتعلق بتوليد المخرجات.
حدود المعدل وموقع البيانات
حدود Ultrafast الافتراضية لـ GPT-6 Astra هي:
- الطبقات 1 إلى 3: 500,000 رمز مميز في الدقيقة.
- الطبقة 4: 1,000,000 رمز مميز في الدقيقة.
- الطبقة 5: 5,000,000 رمز مميز في الدقيقة.
تدعم Ultrafast موقع البيانات في الولايات المتحدة والمعالجة العالمية فقط. إذا كان عقدك يوجه حركة المرور عبر نقطة نهاية في الاتحاد الأوروبي أو منطقة أخرى، فلن تتوفر Ultrafast لهذا المشروع.
متى تدفع Ultrafast تكاليفها: نموذج التعادل
هذا حساب توضيحي مبني على الأسعار المعلنة، وليس معيار أداء. افترض أن قياساتك تظهر أن Astra Standard يبث 40 رمزًا مميزًا للمخرجات في الثانية. استبدل هذا الرقم بقياساتك.
مثال: إجابة موجهة للمستخدم
الطلب يحتوي على:
- 5,000 رمز مميز للمدخلات غير المخزنة مؤقتًا.
- 2,000 رمز مميز للمخرجات.
الحساب:
- Standard: 0.05 دولار للمدخلات + 0.10 دولار للمخرجات = 0.15 دولار.
- Ultrafast: 0.30 دولار للمدخلات + 0.60 دولار للمخرجات = 0.90 دولار.
- الزيادة: 0.75 دولار لكل طلب.
-
زمن التوليد في Standard:
2000 / 40 = 50ثانية. - زمن التوليد في Ultrafast بسرعة 6x: نحو 8.3 ثانية.
- الوقت الموفر: نحو 41.7 ثانية.
-
تكلفة كل ثانية موفرة:
0.75 / 41.7 = 0.018دولار. - تكلفة كل ساعة انتظار موفرة: 64.80 دولارًا.
إذا كان التسارع الفعلي أقل من الحد الأقصى، ترتفع تكلفة الوقت الموفر:
| التسارع المقاس | الثواني الموفرة (من 50) | التكلفة الإضافية لكل ثانية | لكل ساعة موفرة |
|---|---|---|---|
| 6x | 41.7 | $0.018 | $64.80 |
| 4x | 37.5 | $0.020 | $72.00 |
| 2x | 25.0 | $0.030 | $108.00 |
مثال: حلقة وكيل
افترض وكيلًا من 20 خطوة، تحتوي كل خطوة على:
- 20,000 رمز مميز للمدخلات.
- 18,000 رمز مميز مخزن مؤقتًا.
- 2,000 رمز مميز جديد.
- 500 رمز مميز للمخرجات.
- تجاهل رسوم كتابة ذاكرة التخزين المؤقت.
الحساب:
- Standard: 0.018 دولار للمدخلات المخزنة مؤقتًا + 0.020 دولار للمدخلات الجديدة + 0.025 دولار للمخرجات = 0.063 دولار لكل خطوة، أو 1.26 دولار لكل تشغيل.
- Ultrafast: 7.56 دولار لكل تشغيل.
- الزيادة: 6.30 دولار لكل تشغيل.
- زمن التوليد في Standard: 250 ثانية.
- زمن التوليد بسرعة 6x: نحو 41.7 ثانية.
- الوقت الموفر: نحو 208 ثوانٍ.
- تكلفة كل ثانية موفرة: نحو 0.030 دولار، أو 109 دولارات لكل ساعة.
تكون تكلفة الوكيل لكل ثانية موفرة أسوأ لأن الجزء الأكبر من الفاتورة مدخلات، والمدخلات تدفع 6 أضعاف من دون أن تتسارع عملية توليد المخرجات.
السؤال العملي هو: هل ينتظر شخص، أو عملية لها قيمة مالية، هذه الثواني؟ إذا كانت قيمة ساعة الانتظار أعلى من نحو 65 إلى 110 دولارات، فقد تكون Ultrafast منطقية. مثال ذلك مهندس ينتظر وكيل ترميز داخلي أو عميل في خطوة دفع. أما مهمة Cron فلا تستفيد عادةً من ذلك.
متى لا تكون Ultrafast ذات جدوى اقتصادية
- لا أحد ينتظر: التقييمات الليلية، وإعادة التعبئة، والتقارير تناسب واجهة برمجة تطبيقات Batch أو Flex، بتكلفة 5 دولارات للمدخلات و25 دولارًا للمخرجات، أي جزء من اثني عشر من سعر Ultrafast.
- الوكلاء في الخلفية: إذا كان الوكيل يعمل دون مراقبة ويبلغ عند الانتهاء، فنادرًا ما يغير إتمامه قبل دقائق النتيجة.
- المخرجات القصيرة: تصنيف من 50 رمزًا مميزًا لا يملك وقت توليد كافيًا لتقليصه؛ وقد يهيمن إعداد الاتصال وTTFT، خاصة عبر HTTP.
- المطالبات الطويلة: تدفع 6 أضعاف على المدخلات التي لا يغطيها ادعاء السرعة. وفوق 272 ألف رمز مميز للمدخلات، تصل الأسعار إلى 120 دولارًا للمدخلات و450 دولارًا للمخرجات.
- المعالجة الإقليمية: لا توجد نقاط نهاية في الاتحاد الأوروبي.
- الاستدعاءات المقيدة بوقت الوصول إلى أول رمز مميز (TTFT-bound): وجد تحليل وقت الاستجابة لـ GPT-6 Sol أن معظم وقت عمليات التفكير الطويلة قد يمر قبل ظهور أول رمز مميز مرئي. قِس ما إذا كانت Ultrafast تخفض TTFT قبل دفع تكلفتها.
قِس TTFT والوقت الإجمالي في Apidog قبل التبديل
استبدل الأرقام الافتراضية بقياساتك خلال نحو عشر دقائق.
- أنشئ بيئة في Apidog تحتوي على
OPENAI_API_KEY. - أضف طلب
POSTإلى:
https://api.openai.com/v1/responses
وأضف العنوان:
Authorization: Bearer {{OPENAI_API_KEY}}
ثم استخدم هذا الجسم:
{
"model": "gpt-6-astra",
"input": "<your real production prompt>",
"service_tier": "ultrafast",
"stream": true
}
- انسخ الطلب وأزل
service_tierلإنشاء خط أساس Standard. أبقِ المطالبة مطابقة. - أرسل الطلبين. يعرض Apidog تدفق أحداث SSE حدثًا بحدث. سجّل:
- وقت وصول أول
response.output_text.deltaلقياس TTFT. - وقت انتهاء التدفق لقياس الزمن الإجمالي.
- كتلة
usageمن حدثresponse.completedالنهائي لحساب التكلفة.
- وقت وصول أول
- كرر كل متغير 10 مرات على الأقل. قارن المتوسط وp95، لا تشغيلًا فرديًا.
- لحلقات الوكيل، اختبر WebSocket:
- افتح طلب WebSocket إلى
wss://api.openai.com/v1/responses. - استخدم العنوان نفسه.
- أرسل رسالة
response.createبالحقول نفسها، من دونstream. - أرسل دورة ثانية باستخدام
previous_response_id.
- افتح طلب WebSocket إلى
يشرح دليل WebSocket مقابل SSE سبب أهمية الاتصال المفتوح في الاستدعاءات المتتابعة.
احسب الثواني الموفرة بهذه الصيغة:
متوسط الزمن الإجمالي في Standard - متوسط الزمن الإجمالي في Ultrafast
بعد ذلك، سعّر رموز usage بكلا المعدلين، واقسم التكلفة الإضافية على الثواني الموفرة، ثم قارن النتيجة بتكلفة الانتظار في منتجك.
الأسئلة الشائعة
ما هو OpenAI Ultrafast؟
هي طبقة خدمة لواجهة برمجة تطبيقات Responses تولّد الرموز المميزة أسرع بما يصل إلى 6 مرات في واجهة البرمجة مقابل 6 أضعاف السعر القياسي. فعّلها لكل طلب باستخدام service_tier: "ultrafast".
هل Ultrafast نموذج أذكى؟
لا. ستستدعي معرف النموذج نفسه، gpt-6-astra. تغيّر الطبقة السرعة والسعر، لا النموذج.
كم تكلفة GPT-6 Astra Ultrafast؟
في السياق القصير، تبلغ 60 دولارًا للمدخلات، و6 دولارات للمدخلات المخزنة مؤقتًا، و75 دولارًا لكتابة ذاكرة التخزين المؤقت، و300 دولار للمخرجات لكل مليون رمز مميز. في Standard، تبلغ الأسعار 10 دولارات، ودولارًا واحدًا، و12.50 دولارًا، و50 دولارًا على الترتيب.
من أين يأتي رقم «300 رمز مميز في الثانية»؟
إنه رقم OpenAI لـ Ultrafast في Codex، حيث تدعي الشركة سرعة تصل إلى 8 أضعاف. ادعاء واجهة البرمجة يصل إلى 6 أضعاف.
هل يدعم GPT-6.1 Sol خدمة Ultrafast؟
ليس بعد. تقول OpenAI إنها ستأتي قريبًا. راجع ملخص DevDay 2026 لمعرفة ما هو متاح حاليًا.
الخطوة التالية
اختر أبطأ طلب موجه للمستخدم في تطبيقك. شغّله 10 مرات باستخدام Standard و10 مرات باستخدام Ultrafast، ثم قارن متوسط الثواني الموفرة بالتكلفة الإضافية. نزّل Apidog للاحتفاظ بالطلبين، وتوقيتاتهما، وبيانات usage في مشروع واحد.
Top comments (0)