أطلقت علي بابا نموذج Qwen 3.8-Max في أوائل أغسطس 2026، وأخيرًا أصبح لسؤال التسعير إجابة واضحة. خلال فترة المعاينة في يوليو، كانت القصة المتداولة هي عرض «تسعير المعاينة بخصم 10%». انتهى ذلك العرض. عند التوفر العام، تُدرج صفحة أسعار Model Studio الرسمية نموذج qwen3.8-max بسعر 2 دولار لكل مليون توكن إدخال و6 دولارات لكل مليون توكن إخراج، ضمن طبقة سعرية ثابتة واحدة تغطي نافذة السياق الكاملة البالغة مليون توكن.
هذه الطبقة السعرية الثابتة هي الجزء اللافت. تفرض معظم النماذج الرائدة رسومًا أعلى لكل توكن عندما يتجاوز الموجه عتبة سياقية محددة. لا يفعل Qwen 3.8-Max ذلك: سواء أرسلت 5,000 توكن أو 900,000 توكن، يبقى السعر 2 دولار للإدخال و6 دولارات للإخراج.
تغطي هذه المقالة تصميم السعر الثابت، والمقارنة مع Qwen 3.7-Max وKimi K3 وClaude Opus 5 وGPT-5.6 Terra، وخصومات التخزين المؤقت، وشروط الحصة المجانية، وأمثلة تكلفة عملية. للحصول على نظرة أوسع عن النموذج، ابدأ بمقال ما هو Qwen 3.8 ولماذا هو مهم، ثم عد إلى هذه المقالة للأرقام.
ملاحظة مهمة: الأسعار المعلنة تمنحك تقديرًا فقط. يأتي Qwen 3.8-Max بإعداد استدلال افتراضي xhigh، وتُحتسب توكنات التفكير كتوكنات إخراج. الطريقة الموثوقة لتوقع التكلفة هي إرسال طلبات حقيقية وقياس الاستخدام. يعرض Apidog تفصيل توكنات كل استجابة أثناء الاختبار، ما يحول تقدير التكلفة إلى عملية حسابية قابلة للقياس.
الرقم المعلن للتوفر العام: 2 دولار للإدخال و6 دولارات للإخراج
إليك بطاقة الأسعار الرسمية لنموذج qwen3.8-max، كما تظهر في صفحة تسعير Model Studio اعتبارًا من 3 أغسطس 2026:
| العنصر | السعر لكل مليون توكن |
|---|---|
| الإدخال | $2.00 |
| الإخراج، بما في ذلك توكنات التفكير | $6.00 |
| الإدخال المخزن مؤقتًا، إصابة الذاكرة المؤقتة | 10% من سعر الإدخال |
| إنشاء ذاكرة مؤقتة صريح | 125% من سعر الإدخال |
| طبقة السياق | طبقة واحدة من 0 إلى مليون توكن |
| التفكير مقابل عدم التفكير | السعر نفسه |
هناك ثلاث نقاط عملية يجب الانتباه إليها:
- نافذة السياق البالغة مليون توكن مغطاة بسعر واحد، بدون رسوم إضافية للموجهات الطويلة.
- أوضاع التفكير وعدم التفكير تحمل السعر نفسه، لكن توكنات التفكير تُحسب كإخراج.
- الحد الأقصى للإخراج هو 65,536 توكنًا لكل طلب، لذلك يصل الحد الأقصى النظري لفاتورة الإخراج وحدها إلى نحو 0.39 دولار لكل استجابة.
يصف الإعلان الرسمي عن Qwen 3.8 النموذج بأنه الأكثر قدرة من علي بابا حتى الآن: 2.4 تريليون معلمة إجمالية، و95 مليار معلمة نشطة، وسياق بمليون توكن، وإدخال متعدد الوسائط. وفق بطاقة الأسعار، يكلف ذلك 2 دولار للإدخال و6 دولارات للإخراج.
لماذا يعد التسعير الثابت عبر مليون توكن غير معتاد؟
التسعير المتدرج للسياق هو القاعدة في الصناعة: سعر أقل تحت عتبة سياقية معينة، ثم سعر أعلى بعد تجاوزها، لأن خدمة السياقات الطويلة أكثر تكلفة.
تطبق علي بابا هذا النمط في نماذج أخرى أيضًا. في صفحة تسعير Model Studio، تُسعّر نماذج مثل qwen3-max وqwen3-coder-plus وفق طبقات لطول السياق، حيث يرتفع سعر التوكن كلما طال الإدخال.
لكن Qwen 3.8-Max يكسر هذا النمط داخل كتالوج علي بابا نفسه: يظهر في جدول أسعاره صف واحد فقط:
0 < token ≤ 1,000,000
بالنسبة إلى التنفيذ، هذا يعني أن الميزانية خطية:
التكلفة = (توكنات الإدخال × 2 دولار / 1,000,000)
+ (توكنات الإخراج × 6 دولارات / 1,000,000)
يفيد ذلك خصوصًا في:
- تحليل المستندات الطويلة.
- وكلاء قواعد المعرفة الكبيرة.
- أنظمة RAG التي تضيف مئات الآلاف من التوكنات إلى السياق.
- تطبيقات الدردشة ذات موجهات النظام الطويلة.
أرخص من Qwen 3.7-Max بالسعر المعلن
أُطلق Qwen 3.8-Max بسعر معلن أقل من سابقه:
- Qwen 3.7-Max: 2.5 دولار للإدخال و7.5 دولار للإخراج لكل مليون توكن.
- Qwen 3.8-Max: 2 دولار للإدخال و6 دولارات للإخراج لكل مليون توكن.
يمثل ذلك تخفيضًا بنسبة 20% على جانبي الإدخال والإخراج، مع نافذة سياق أكبر وإدخال متعدد الوسائط ونتائج معيارية أفضل وفق الإعلان.
لكن توجد نقطة مهمة: لدى Qwen 3.7-Max عرض ترويجي بخصم 50%، ما يخفض سعره إلى:
1.25 دولار للإدخال / 3.75 دولار للإخراج
لذلك، إذا لم يكن حمل العمل يحتاج إلى سياق مليون توكن أو قدرات Qwen 3.8 متعددة الوسائط والوكيلية، فقد يكون Qwen 3.7-Max المخفض خيارًا أقل تكلفة ما دام العرض قائمًا. لا تبنِ نموذج تكلفة طويل الأجل على سعر ترويجي.
للمهام الأقل تكلفة، يبقى Qwen 3.7-Plus خيارًا عمليًا بسعر 0.4 دولار للإدخال و1.6 دولار للإخراج، مع عرض ترويجي خاص به بخصم 20%.
توكنات التفكير تُحسب كإخراج
هذه النقطة قد تكون السبب الأكبر لفروقات الفاتورة الفعلية.
يدعم Qwen 3.8-Max معلمة reasoning_effort بثلاثة مستويات:
xhigh
medium
low
القيمة الافتراضية هي xhigh. في وضع التفكير، يولد النموذج توكنات استدلال داخلية قبل إنتاج الإجابة النهائية. هذه التوكنات تُحتسب بسعر الإخراج، أي 6 دولارات لكل مليون توكن.
بالتالي، لا يكفي تقدير التكلفة بهذه الصيغة:
توكنات الموجه + توكنات الإجابة المرئية
بل يجب أن تشمل توكنات التفكير:
إجمالي توكنات الإخراج =
توكنات الإجابة المرئية + توكنات التفكير
خطوات عملية لتقليل التكلفة
- استخدم
mediumأوlowللمهام البسيطة، مثل التصنيف والاستخراج وإعادة التنسيق. - احتفظ بـ
xhighللمهام التي تتطلب استدلالًا عميقًا. - راقب كائن
usageفي كل استجابة. - افصل تقارير الإدخال والإخراج حسب نوع المهمة، ثم ابنِ تقديرك الشهري على المتوسطات المقاسة.
مثال إعداد طلب:
{
"model": "qwen3.8-max",
"messages": [
{
"role": "user",
"content": "استخرج الحقول المطلوبة من هذا النص."
}
],
"reasoning_effort": "low"
}
التخزين المؤقت للسياق: 10% للإصابات و125% للإنشاء
إذا كان تطبيقك يعيد إرسال بادئة موجه متكررة، مثل موجه نظام طويل أو وثائق ثابتة أو تعريفات أدوات، فإن التخزين المؤقت للسياق يغير التكلفة بشكل ملحوظ.
-
إصابات الذاكرة المؤقتة: تُحسب بنسبة 10% من سعر الإدخال.
- أي 0.20 دولار لكل مليون توكن بدلًا من 2 دولار.
-
إنشاء الذاكرة المؤقتة الصريح: يُحسب بنسبة 125% من سعر الإدخال.
- أي 2.50 دولار لكل مليون توكن.
يمكن حساب نقطة التعادل بسرعة:
- تدفع 25% إضافية مرة واحدة عند إنشاء الذاكرة المؤقتة.
- كل إعادة استخدام لاحقة تخفض تكلفة الإدخال بنسبة 90%.
- عند إعادة استخدام البادئة مرتين فقط، يبدأ التخزين المؤقت في تعويض كلفته.
استخدمه عندما تتكرر عناصر مثل:
- تعليمات النظام
- تعريفات الأدوات
- وثائق المنتج
- قاعدة معرفة ثابتة
- مخططات JSON أو OpenAPI كبيرة
تفاصيل الحصة المجانية: مليون توكن وسنغافورة و90 يومًا
يوفر Model Studio حصة مجانية لنموذج qwen3.8-max، لكن التفاصيل مهمة:
- الحجم: مليون توكن.
- المنطقة: سنغافورة فقط.
- المدة: 90 يومًا من التفعيل.
لاستخدام الحصة المجانية، وجّه العميل إلى نقطة النهاية التالية:
https://dashscope-intl.aliyuncs.com/compatible-mode/v1
لا تنطبق الحصة على بكين أو فيرجينيا في الولايات المتحدة.
تُسحب توكنات التفكير من الحصة المجانية مثل أي توكنات إخراج أخرى، لذلك قد تستنفد مهام الاستدلال الكثيفة باستخدام xhigh الحصة أسرع من المتوقع.
لخيارات الوصول المجاني الأخرى، راجع كيفية استخدام Qwen 3.8 مجانًا.
كيف تقارن أسعار Qwen 3.8؟
فيما يلي مقارنة بالأسعار المعلنة لكل مليون توكن. الأسعار الترويجية مؤقتة وقد تنتهي.
| النموذج | الإدخال | الإخراج | ملاحظات |
|---|---|---|---|
| Qwen 3.8-Max | $2.00 | $6.00 | ثابت عبر سياق مليون توكن؛ إصابات الذاكرة المؤقتة 10% |
| Qwen 3.7-Max | $2.50 | $7.50 | خصم 50% حاليًا: $1.25 / $3.75 |
| Qwen 3.7-Plus | $0.40 | $1.60 | خصم 20% حاليًا |
| Kimi K3 | $3.00 | $15.00 | إصابات الذاكرة المؤقتة: $0.30 |
| Claude Opus 5 | $5.00 | $25.00 | — |
| GPT-5.6 Terra | $2.00 | $12.00 | — |
قراءة سريعة للجدول
- مقابل Kimi K3: يكلف Qwen 3.8-Max أقل بثلث للإدخال وأقل بنسبة 60% للإخراج. كما أن إصابة الذاكرة المؤقتة تكلف 0.20 دولار مقابل 0.30 دولار في K3. راجع دليل Kimi K3 API لتفاصيل جانب K3.
- مقابل Claude Opus 5: Qwen أرخص بنسبة 60% للإدخال و76% للإخراج.
- مقابل GPT-5.6 Terra: سعر الإدخال متطابق عند 2 دولار، لكن إخراج Qwen بنصف السعر.
السعر ليس مقياس جودة. اختبر النماذج على بياناتك ومهامك الفعلية بدل الاعتماد على بطاقة الأسعار أو المعايير المنشورة فقط.
أمثلة عملية: تكلفة المهام الحقيقية
المثال 1: جلسة وكيل بـ50 ألف توكن
لنفترض أن جلسة وكيل تستخدم:
- 38,000 توكن إدخال.
- 12,000 توكن إخراج.
الحساب:
الإدخال:
38,000 × 2 / 1,000,000 = 0.076 دولار
الإخراج:
12,000 × 6 / 1,000,000 = 0.072 دولار
الإجمالي:
0.148 دولار ≈ 0.15 دولار لكل جلسة
إذا أضاف إعداد xhigh نحو 8,000 توكن تفكير، يصبح إجمالي الإخراج 20,000 توكن:
الإخراج:
20,000 × 6 / 1,000,000 = 0.12 دولار
إجمالي الجلسة:
0.076 + 0.12 = 0.196 دولار ≈ 0.20 دولار
هذا يعني أن الاستدلال وحده رفع تكلفة الجلسة بنحو 33%.
المثال 2: تحليل مستند طويل بـ800 ألف توكن
لنفترض أنك ترسل 800,000 توكن من المستندات وتطلب ملخصًا منظمًا من 5,000 توكن:
الإدخال:
800,000 × 2 / 1,000,000 = 1.60 دولار
الإخراج:
5,000 × 6 / 1,000,000 = 0.03 دولار
الإجمالي:
1.63 دولار لكل عملية تشغيل
الميزة هنا أن كل توكن من الـ800 ألف يُسعّر بنفس سعر الإدخال الأساسي، بدون انتقال إلى طبقة سياق أغلى.
المثال 3: موجه نظام مخزن مؤقتًا بـ100 ألف توكن و50 استدعاءً يوميًا
لنفترض أن تطبيقك يرسل في كل استدعاء:
100,000 توكن من:
- موجه النظام
- وثائق المنتج
- تعريفات الأدوات
بدون تخزين مؤقت:
100,000 × 2 / 1,000,000 = 0.20 دولار لكل استدعاء
0.20 × 50 = 10.00 دولارات يوميًا
مع تخزين مؤقت صريح:
تكلفة الإنشاء:
100,000 × 2.50 / 1,000,000 = 0.25 دولار
تكلفة 49 إصابة ذاكرة مؤقتة:
49 × (100,000 × 0.20 / 1,000,000)
= 49 × 0.02
= 0.98 دولار
الإجمالي اليومي:
0.25 + 0.98 = 1.23 دولار
النتيجة: توفير يقارب 88% مقارنة بإرسال البادئة نفسها دون تخزين مؤقت.
قدّر التكاليف بناءً على الاستخدام المقاس
تعتمد الأمثلة السابقة على أعداد توكنات مفترضة. تختلف أرقام الإنتاج الفعلية، خصوصًا مع توكنات التفكير. لا تعتمد على طول الموجه فقط؛ قِس الاستخدام الحقيقي.
سير عمل عملي
- احصل على مفتاح API.
- جهّز نقطة النهاية الخاصة بمنطقتك.
- أرسل طلبات تمثيلية لكل نوع مهمة.
- اقرأ كائن
usageمن كل استجابة. - افصل القياسات حسب
reasoning_effort. - احسب المتوسط لكل نوع مهمة.
- اضرب المتوسط في أسعار الإدخال والإخراج.
الصيغة:
التكلفة المتوقعة لكل طلب =
(input_tokens / 1,000,000 × 2)
+
(output_tokens / 1,000,000 × 6)
يغطي دليل Qwen 3.8 API عناوين URL الأساسية الإقليمية الثلاثة وبروتوكولي OpenAI-compatible وAnthropic-compatible.
في Apidog، يمكنك حفظ عناوين URL الأساسية كبيئات منفصلة، ثم إرسال الطلب نفسه مع كل مستوى من reasoning_effort ومراجعة استخدام التوكنات مباشرة من الاستجابة.
جرّب 10 طلبات تمثيلية على الأقل لكل نوع مهمة، ثم احسب المتوسط بدل الاعتماد على طلب واحد. يمكنك أيضًا تشغيل اختبار A/B للموجه نفسه بين qwen3.8-max وqwen3.7-max أو Kimi K3 داخل مساحة العمل نفسها.
يمكنك تنزيل Apidog مجانًا وبدء جمع أرقام تكلفة فعلية لكل مهمة.
الخلاصة
يقدم Qwen 3.8-Max سعرًا معلنًا قدره 2 دولار للإدخال و6 دولارات للإخراج لنموذج رائد من الفئة المتقدمة. وهو أقل من السعر المعلن لسابقه، ويكلف نصف سعر إخراج GPT-5.6 Terra، ويظل ثابتًا عبر سياق كامل يبلغ مليون توكن.
لتحويل بطاقة الأسعار إلى تكلفة تشغيل فعلية:
- قِس
usageعلى طلبات واقعية. - راقب توكنات التفكير باعتبارها توكنات إخراج.
- لا تستخدم
xhighتلقائيًا لكل المهام. - فعّل التخزين المؤقت للبادئات المتكررة.
- لا تبنِ تقديرك طويل الأجل على الحصص أو الخصومات الترويجية.
الأسئلة الشائعة
هل يكلف Qwen 3.8 أكثر للموجهات الطويلة؟
لا. تعرض الأسعار الرسمية طبقة واحدة من 0 إلى مليون توكن، لذلك يُحسب موجه من 900 ألف توكن بسعر الإدخال نفسه: 2 دولار لكل مليون توكن. يختلف ذلك عن النماذج ذات التسعير المتدرج، بما في ذلك بعض النماذج ضمن قائمة نماذج Model Studio.
هل تكلف توكنات التفكير رسومًا إضافية في Qwen 3.8؟
لا يوجد سعر منفصل للتفكير. لكن توكنات التفكير تُحسب ضمن توكنات الإخراج بسعر 6 دولارات لكل مليون توكن، والإعداد الافتراضي لـreasoning_effort هو xhigh. لذلك قد تكلف طلبات الاستدلال أكثر مما توحي به الإجابة المرئية وحدها.
هل هناك طريقة مجانية لتجربة Qwen 3.8؟
نعم. يتضمن Model Studio حصة مجانية قدرها مليون توكن صالحة لمدة 90 يومًا على نقطة نهاية سنغافورة فقط. يوفر Qwen Chat أيضًا وصولًا مجانيًا من المتصفح. راجع كيفية استخدام Qwen 3.8 مجانًا للتفاصيل.
هل لا يزال «تسعير المعاينة بخصم 10%» متاحًا؟
لا. كان عرضًا ترويجيًا لفترة المعاينة في يوليو 2026. حلّ التوفر العام محله ببطاقة الأسعار القياسية: 2 دولار للإدخال و6 دولارات للإخراج. استخدم صفحة تسعير Model Studio كمصدر الحقيقة.
Top comments (0)