تكلفة GLM-5.3-Flash: ما تدفعه الآن وما يجب أن تخطط له بعد 9 سبتمبر
يتوفر GLM-5.3-Flash حاليًا بنصف السعر، لكن العرض ينتهي في 9 سبتمبر 2026. بعد ذلك ستتضاعف تقديرات التكلفة المبنية على الأسعار الحالية. تغطي هذه المقالة التكلفة الفعلية، وأثر التخزين المؤقت وجهد التفكير، ومقارنة البدائل، ومتى تستحق الاستضافة الذاتية.
تم التحقق من جميع الأرقام في 27 أغسطس 2026. تتغير صفحات التسعير، لذلك تحقّق من مزود الخدمة قبل إعداد الميزانية.
بطاقة الأسعار
| سعر الإطلاق حتى 9 سبتمبر 2026 | السعر الأساسي بعد ذلك | |
|---|---|---|
| المدخلات | $0.075 / مليون رمز | $0.15 / مليون رمز |
| المخرجات | $0.25 / مليون رمز | $0.50 / مليون رمز |
| المدخلات المخزنة مؤقتًا | $0.015 / مليون رمز | $0.03 / مليون رمز |
تنشر Artificial Analysis سعرًا مختلطًا قدره $0.10 لكل مليون رمز باستخدام نسبة 7:2:1 بين الرموز المخزنة مؤقتًا والمدخلات والمخرجات. هذا الرقم مفيد للمقارنة، لكن نسب الاستخدام الفعلية هي التي تحدد فاتورتك.
التكلفة العملية بعد انتهاء الخصم
فيما يلي ثلاثة أمثلة باستخدام السعر الأساسي، وهو الرقم المناسب للتخطيط ابتداءً من 10 سبتمبر.
مصنف دعم: 100,000 تذكرة شهريًا، بمتوسط 800 رمز إدخال و100 رمز إخراج لكل تذكرة.
80 مليون رمز إدخال = $12.00، و10 ملايين رمز إخراج = $5.00، بإجمالي $17 شهريًا. استخدامreasoning_effort=lowقد يخفض تكلفة المخرجات أكثر.مساعد برمجة: 500 جلسة يوميًا، بمتوسط 15,000 رمز إدخال و2,000 رمز إخراج لكل جلسة.
شهريًا: 225 مليون رمز إدخال و30 مليون رمز إخراج. من دون التخزين المؤقت، التكلفة $48.75: $33.75 للمدخلات و$15.00 للمخرجات. إذا وصلت 70% من المدخلات إلى الذاكرة المؤقتة، تنخفض تكلفة المدخلات إلى نحو $14.85، ويصبح الإجمالي حوالي $30.مسار مستندات مع صور: 10,000 مستند شهريًا، بمتوسط 40,000 رمز إدخال، بما في ذلك محتوى الصور، و1,500 رمز إخراج لكل مستند.
400 مليون رمز إدخال = $60.00، و15 مليون رمز إخراج = $7.50، بإجمالي $67.50 شهريًا.
هذه التكاليف منخفضة نسبيًا، وهذه هي نقطة قوة النموذج.
التخزين المؤقت للمدخلات هو العامل الأهم
بسعر $0.03 لكل مليون رمز مخزن مؤقتًا مقابل $0.15 للمدخلات الجديدة، تكلف الرموز المخزنة خُمس تكلفة الرموز غير المخزنة.
لتحقيق أعلى معدل استفادة:
- ضع بادئة ثابتة، مثل موجه النظام أو المستند المتكرر أو قاعدة الأكواد، في بداية الموجه.
- ضع البيانات المتغيرة في نهايته.
- حافظ على تطابق البادئة حرفيًا بين المكالمات.
تجنب وضع طابع زمني أو معرف طلب أو اسم مستخدم في بداية الموجه؛ فأي تغيير هناك قد يبطل التخزين المؤقت لكل ما يليه.
أدرجت Z.ai التخزين المؤقت للمدخلات مجانًا لفترة محدودة. تعامل مع ذلك كعرض ترويجي، وتحقق من الشروط الحالية قبل بناء بنية تعتمد عليه.
العامل الثاني: جهد التفكير
القيمة الافتراضية لـ reasoning_effort هي max، وهي أغلى إعداد. الخيارات المتاحة هي:
lowhighmax
تُحاسب رموز التفكير كمخرجات. لذلك قد تدفع تكلفة مخرجات إضافية لا تظهر في الإجابة النهائية، خصوصًا في مهام التصنيف والاستخراج والتوجيه والتنسيق.
ابدأ بـ low في المهام التي لا تحتاج إلى استدلال عميق؛ فقد يقلل ذلك تكلفة المخرجات بوضوح. يشرح دليل API الخاص بنا كيفية ضبط المعامل، وهو تغيير صغير يستحق التجربة قبل البحث عن حلول أخرى.
مقارنة النماذج
بالسعر الأساسي:
| النموذج | متوسط السعر لكل مليون رمز |
|---|---|
| GLM-5.3-Flash | $0.10 |
| GLM-5.3 | $0.90 |
الفارق يقارب تسعة أضعاف مقابل فارق ثلاث نقاط فقط في مؤشر ذكاء Artificial Analysis: 57 مقابل 60.
توضح مقارنتنا الكاملة متى لا يكون هذا التبادل مناسبًا. باختصار، إذا كنت تبث ردودًا طويلة إلى مستخدم ينتظر، فقد يكون GLM-5.3 أفضل لأنه يولد النص بسرعة تقارب الضعف.
وبالمقارنة مع GLM-5.2، تدعي Z.ai أن السعر يعادل تقريبًا عُشر السعر، إلى جانب تكلفة مهمة تبلغ $0.045. راجع تحليل تسعير GLM-5.2 إذا كنت تخطط للترحيل.
مقابل نماذج الوسائط المتعددة منخفضة التكلفة من مزودين آخرين، يتميز GLM-5.3-Flash بسعر تنافسي وترخيص MIT، ما يجعل الاستضافة الذاتية ممكنة. وللمقارنة مع Google، راجع تحليل تسعير Gemini 3.7 Flash.
أسعار المزودين ليست متطابقة
يتوفر النموذج مباشرة عبر Z.ai، وكذلك عبر:
- OpenRouter
- Cloudflare Workers AI
- Vercel AI Gateway
- DeepInfra
- Novita
- GMICloud
- Baseten
- io.net
لا يفرض هؤلاء السعر نفسه. على سبيل المثال، أدرجت AIHubMix أسعارًا تقارب $0.113 للمدخلات و$0.394 للمخرجات، وهي بين أسعار Z.ai الترويجية والأساسية. بعض المزودين يمررون خصم الإطلاق، بينما لا يفعل الآخرون ذلك.
إذا كنت تستخدم مجمعًا، فتحقق من سعره الحالي بدل افتراض أنه يطابق سعر Z.ai. قد تضيف البوابة الموحدة هامشًا إضافيًا، حتى لو كان صغيرًا بالقيمة المطلقة.
متى تستحق الاستضافة الذاتية؟
الأوزان مرخصة بترخيص MIT، لكن انخفاض سعر API يجعل نقطة التعادل أصعب.
كإطار تقريبي، يتطلب تقديم النموذج بدقة كاملة عقدة من فئة 8x H200، بتكلفة سحابية تتراوح بين $24 و$48 يوميًا. استخدم تقديرًا قدره $1,000 شهريًا كتكلفة ثابتة، سواء كانت العقدة مشغولة أم خاملة.
بالسعر الأساسي، يشتري $1,000 نحو 6.7 مليار رمز إدخال. لذلك تحتاج إلى حجم استخدام هائل ومستمر قبل أن تتجاوز تكلفة API تكلفة العقدة. بالنسبة لمعظم الفرق، ترتبط الاستضافة الذاتية بالتحكم أو إقامة البيانات أو الترخيص أكثر من ارتباطها بالتوفير المالي.
الاستثناء هو النماذج المكممة. تتوفر إصدارات GGUF، وتشغيل نموذج مكمم على أجهزة تملكها مسبقًا يجعل التكلفة الهامشية أقرب إلى تكلفة الكهرباء. يوضح دليل التشغيل المحلي ما يمكن لكل فئة من الأجهزة تشغيله عمليًا.
بديل خطة البرمجة
إذا كان استخدامك يقتصر على البرمجة عبر Claude Code أو Cline، وليس على تطبيق يستدعي API، فقد لا يكون الدفع لكل رمز الخيار الأفضل.
تبدأ خطة ترميز GLM من نحو $18 شهريًا، وتشمل GLM-5.3-Flash، ويُقال إنها توفر ثلاثة أضعاف الحصة القابلة للاستخدام مقارنةً بـ GLM-5.3. كما تذكر وثائق Z.ai أن المكالمات خارج أوقات الذروة تستهلك نصف النقاط القياسية.
لمطور واحد يبرمج يوميًا، تكون الخطة الثابتة عادةً أرخص وأكثر قابلية للتنبؤ من API حسب الاستخدام. يشرح دليل إعداد الواجهة طريقة التوصيل، بينما تقارن مقالة خطط البرمجة خطة GLM بالبدائل.
راقب المخرجات
تجذب أسعار المدخلات الانتباه لأن أحجامها أكبر، لكن المخرجات هي مصدر تجاوز الميزانية غالبًا:
- تكلفة المخرجات أكثر من ثلاثة أضعاف تكلفة المدخلات لكل رمز: $0.50 مقابل $0.15.
- تُحسب رموز التفكير كمخرجات.
- قد ينتج إعداد
reasoning_effort=maxرموزًا أكثر بكثير من النص الظاهر للمستخدم. - لا تعكس النسبة المختلطة 7:2:1 كثيرًا من أحمال العمل الحقيقية.
لذلك قد يصبح تطبيق ذو موجه صغير ونموذج ثرثار مهيمنًا على المخرجات، رغم أنه يبدو كثيف المدخلات على الورق.
الحل هو القياس الفعلي. تحتوي كل استجابة إكمال على كائن usage الذي يوضح عدد رموز المدخلات والمخرجات والرموز المخزنة مؤقتًا:
- سجّل قيم
usageلكل استجابة. - اجمعها حسب الفترة أو المستخدم أو المهمة.
- قارن النسبة الحقيقية بافتراض الميزانية.
- إذا تجاوزت المخرجات نحو 15% من إجمالي الرموز، راجع
reasoning_effortأولًا، ثم طول الموجه.
ما الذي ينبغي فعله قبل 9 سبتمبر؟
نفّذ هذه الخطوات قبل انتهاء الخصم:
- قِس مزيج الرموز الفعلي. النسبة المفترضة هي 7:2:1؛ وإذا كان استخدامك كثيف المخرجات فستقترب التكلفة من $0.50 لكل مليون رمز، لا من الرقم المختلط $0.10.
- تحقق من معدل التخزين المؤقت. الفارق البالغ خمسة أضعاف بين المدخلات المخزنة والجديدة هو أكبر فرصة مباشرة للتوفير.
- أعد حساب الميزانية بالسعر الأساسي. ستتضاعف الأسعار في 10 سبتمبر. إذا كان عبء العمل مربحًا فقط أثناء العرض، عالج المشكلة الآن.
-
أعد تشغيل مجموعة محفوظة من الطلبات. التقط الاستجابات الفعلية وكائنات
usage، ثم شغّل الطلبات التمثيلية كمجموعة في Apidog، مع تمرير معرف النموذج كمتغير بيئة. بهذه الطريقة يمكنك مقارنة الفاتورة الفعلية مع GLM-5.3 بدل الاعتماد على أرقام التسويق.
الأسئلة الشائعة
هل GLM-5.3-Flash مجاني؟
لا. كان مجانيًا لنحو أسبوع أثناء تشغيله بشكل مجهول باسم "ox-alpha" قبل الإطلاق، لكن ذلك انتهى عند الإعلان. الخصم الحالي بنسبة 50% لا يعني أنه مجاني.
متى ينتهي الخصم؟
في 9 سبتمبر 2026، وتبدأ الأسعار الأساسية من ذلك التاريخ.
لماذا تختلف الأسعار بين المواقع؟
لأن بعض المواقع تعرض السعر الترويجي، وبعضها يعرض السعر الأساسي، كما يضيف كل مزود هامشه الخاص. تحقق من سعر المزود الذي تستخدمه فعليًا.
هل تكلف مدخلات الصور رسومًا إضافية؟
لا توجد رسوم منفصلة للصور؛ فهي تستهلك رموز السياق وتُحاسب كمدخلات. لكن الصور عالية الدقة قد تستهلك عددًا كبيرًا من الرموز.
هل الاستضافة الذاتية أرخص؟
فقط عند أحجام استخدام كبيرة ومستمرة، أو عند تشغيل نموذج مكمم على أجهزة تملكها مسبقًا. بسعر $0.15 لكل مليون رمز إدخال، يصعب تبرير استئجار عقدة 8x H200 بناءً على التكلفة وحدها.
Top comments (0)