بنت DeepSeek قاعدتها من المطورين على معادلة بسيطة: نماذج شبه رائدة بأسعار تجعل العداد غير ذي صلة. في 6 أغسطس 2026، حذرت الشركة من أن هذه المعادلة على وشك التغيير. في إعلان غطته Dataconomy لأول مرة، قالت DeepSeek إن أسعار واجهة برمجة التطبيقات (API) سترتفع "في المدى القريب"، وإن الزيادة متوقعة أن تكون "كبيرة". لم تعلن الشركة أرقامًا أو تاريخًا للسريان أو تفاصيل حسب النموذج ومستوى التسعير.
السياق يجعل التحذير ذا مصداقية. تشير DeepSeek إلى ارتفاع تكاليف الحوسبة، واختناقات القدرة، وحركة المرور الكثيفة على V4-Flash وV4-Pro. وهذا هو التغيير الثاني في الأسعار خلال أقل من شهر، بعد طرح أسعار الذروة وخارج الذروة في منتصف يوليو. كما يأتي التحذير قبل وصول V4 Pro 0813 إلى التوفر العام في 12 أغسطس، ما قد يدفع الطلب إلى الارتفاع. ويصف eWeek الخطوة بأنها اختبار للميزة منخفضة التكلفة التي جعلت DeepSeek خيارًا شائعًا للفرق في آسيا والمحيط الهادئ وخارجها.
لا يمكنك التحكم في الأسعار الجديدة، لكن يمكنك التحكم في عدد الرموز التي تشتريها، والنموذج المستخدم، ووقت التنفيذ، والمزود. يوضح هذا الدليل خمس خطوات عملية لتقليل تعرضك قبل سريان الزيادة، مع نموذج تقريبي لفواتير بزيادات قدرها 1.5x و2x و3x.
ملخص سريع
- أعلنت DeepSeek في 6 أغسطس 2026 عن زيادة "كبيرة" في أسعار API، من دون تحديد المبلغ أو التاريخ أو تفاصيل كل نموذج.
- التخزين المؤقت التلقائي لبادئات المطالبات هو أكبر وسيلة لتقليل التكلفة؛ فالمدخلات المخزنة مؤقتًا تُفوتر بأقل من 1% من معدل عدم المطابقة.
- استخدم V4-Flash للمكالمات البسيطة مرتفعة الحجم، وV4-Pro للتفكير والتحليل العميق.
- حدّد ميزانية التفكير لكل مسار حتى لا تدفع تكلفة الاستدلال لمهام التصنيف أو التنسيق.
- انقل الأعمال الدفعية إلى فترات خارج الذروة التي طرحتها DeepSeek في منتصف يوليو.
- جهّز مزودًا ثانيًا. يمكنك تشغيل مجموعة اختبار واحدة عبر Apidog للتحقق من أن خطة التحويل الاحتياطية تعمل.
- حتى في سيناريو زيادة قدرها 3x، سيكلف إخراج V4-Pro نحو 2.61 دولارًا لكل مليون رمز، مقارنةً بـ25–30 دولارًا المنسوبة إلى بعض النماذج المنافسة في المقارنات العامة. استعد، لكن لا داعي للذعر.
ما أعلنته DeepSeek وما لم تعلنه
الإفصاح الرسمي محدود: سترتفع أسعار API "في المدى القريب"، وستكون الزيادة "كبيرة"، والسبب هو تكاليف الحوسبة واختناقات القدرة والمرور المرتفع على نقطتي نهاية V4-Flash وV4-Pro. وحتى 13 أغسطس، لا تزال الأسعار الحالية سارية.
لم تحدد DeepSeek:
- مقدار الزيادة.
- تاريخ بدء الأسعار الجديدة.
- ما إذا كان V4-Flash وV4-Pro سيتحركان بالمعدل نفسه.
- ما إذا كانت أسعار مطابقة ذاكرة التخزين المؤقت ستتغير بالتناسب مع أسعار عدم المطابقة.
- ما إذا كانت أعباء عمل التفكير ستخضع لمعاملة مختلفة.
تتحدث بعض نقاشات Hacker News عن زيادة بين 2x و3x، لكن ذلك غير مؤكد رسميًا. لذلك خطط لنطاق من السيناريوهات، لا لرقم واحد.
بطاقة الأسعار الحالية
| النموذج | المدخلات — عدم مطابقة ذاكرة التخزين المؤقت | المدخلات — مطابقة ذاكرة التخزين المؤقت | المخرجات |
|---|---|---|---|
| DeepSeek V4-Pro | $0.435 / مليون رمز | $0.003625 / مليون رمز | $0.87 / مليون رمز |
| DeepSeek V4-Flash | $0.14 / مليون رمز | — | $0.28 / مليون رمز |
يحمل كلا النموذجين نافذة سياق بحجم مليون رمز. راجع دليل تسعير واجهة برمجة التطبيقات DeepSeek V4 للتفاصيل، وبطاقة الأسعار المباشرة في وثائق واجهة برمجة التطبيقات DeepSeek.
هناك فارقان مهمان في الجدول:
- المدخلات المخزنة مؤقتًا أرخص من المدخلات غير المخزنة مؤقتًا بأكثر من 99%.
- تبلغ تكلفة V4-Pro نحو ثلاثة أضعاف تكلفة V4-Flash للمدخلات والمخرجات.
تستفيد الخطوات التالية من هذين الفارقين.
الخطوة 1: قِس تعرضك قبل سريان السعر
زيادة السعر هي مضاعف لرقم يجب أن تعرفه أولًا. قبل إعادة كتابة المطالبات أو تغيير النماذج، اربط كل استدعاء بالميزة التي تسببت فيه وسجّل استخدام الرموز الفعلي:
usage = response.usage
log.info("llm_call", extra={
"feature": "ticket-summarizer",
"model": "deepseek-v4-flash",
"input_tokens": usage.prompt_tokens,
"output_tokens": usage.completion_tokens,
"cache_hit_tokens": usage.prompt_cache_hit_tokens,
})
يمكنك تطبيق النمط نفسه على DeepSeek كما هو موضح في دليل تتبع إنفاق OpenAI API لكل ميزة.
اجمع أسبوعًا من البيانات على الأقل، ثم أجب عن الأسئلة التالية:
- ما الميزات التي تستهلك معظم الميزانية؟
- ما نسبة رموز الإدخال التي تصل إلى ذاكرة التخزين المؤقت؟
- كم من استخدام V4-Pro ينجز مهام يمكن أن ينفذها V4-Flash؟
- ما تكلفة الوحدة لكل ميزة، وكيف تتغير في سيناريوهات الزيادة؟
استخدم تكلفة الوحدة الحالية كعتبة لاتخاذ قرار التحويل في الخطوة الخامسة.
الخطوة 2: ارفع معدل مطابقة ذاكرة التخزين المؤقت
تخزن DeepSeek بادئات المطالبات مؤقتًا تلقائيًا. عندما تتطابق الرموز الافتتاحية مع طلب حديث، تُحاسب هذه البادئة بمعدل المطابقة. على V4-Pro، يعني ذلك $0.003625 لكل مليون رمز بدلًا من $0.435.
لا توجد علامات للتحكم في ذاكرة التخزين المؤقت أو إدارة مباشرة لـTTL؛ لذلك يعتمد الخصم على استقرار بنية المطالبة. يشرح دليل التخزين المؤقت للمطالبات الآلية بمزيد من التفصيل.
اجعل البادئة ثابتة بالبايت
اتبع هذه القواعد عند بناء الرسائل:
- ضع المحتوى الثابت أولًا: مطالبة النظام، تعريفات الأدوات، الأمثلة، وسياسات الإخراج.
- انقل المحتوى المتغير إلى النهاية: رسالة المستخدم، المستندات المسترجعة، وبيانات الجلسة.
- أزل العناصر المتغيرة من بداية المطالبة، مثل الطوابع الزمنية ومعرّفات الطلبات والتحيات الشخصية.
- ثبّت ترتيب الأدوات والحقول عند التسلسل؛ فالترتيب غير الحتمي قد يكسر المطابقة.
- في المحادثات متعددة الأدوار، أعد إرسال البادئة الثابتة بالطريقة نفسها في كل دور.
مثال على بنية أفضل:
[رسالة النظام الثابتة]
[تعريفات الأدوات الثابتة]
[أمثلة الإخراج الثابتة]
[سياق الجلسة المتغير]
[المستندات المسترجعة]
[رسالة المستخدم الحالية]
راقب معدل المطابقة من كل استجابة
تبلغ DeepSeek عن رموز المطابقة وعدم المطابقة في كائن usage، وفقًا لـوثائق واجهة برمجة التطبيقات DeepSeek:
u = response.usage
total_prompt_tokens = (
u.prompt_cache_hit_tokens +
u.prompt_cache_miss_tokens
)
hit_rate = (
u.prompt_cache_hit_tokens / total_prompt_tokens
if total_prompt_tokens
else 0
)
تتبع hit_rate لكل ميزة. إذا كانت البنية متكررة لكن معدل المطابقة منخفض، فابحث عن جزء متغير في بداية المطالبة. غالبًا ما يكفي نقل ذلك الجزء إلى النهاية لرفع المعدل.
الخطوة 3: وجّه الطلبات حسب المهمة
V4-Pro مناسب للتفكير العميق، لكنه مكلف لإعادة تنسيق JSON أو تصنيف النصوص. لا تجعل النموذج الذي استخدمته أثناء بناء النموذج الأولي هو النموذج الافتراضي لكل الإنتاج.
| شكل حمل العمل | النموذج المقترح |
|---|---|
| التصنيف، الاستخراج، التنسيق، وتوجيه النوايا | V4-Flash مع أقل قدر من التفكير |
| التلخيص، إجابات RAG، وتوليد المسودات | V4-Flash أولًا؛ الترقية إلى Pro عند فشل التقييمات |
| حلقات الوكلاء متعددة الخطوات، التصحيح الصعب، وتحليل البنية | V4-Pro مع ميزانية تفكير |
اختبر التحويل بدلًا من الاعتماد على الانطباع:
- انقل مسارًا واحدًا من Pro إلى Flash.
- شغّل مجموعة التقييم نفسها.
- قارن الجودة، معدل الفشل، وزمن الاستجابة.
- احتفظ بالتغيير إذا بقيت الجودة ضمن الحد المقبول.
حدّد ميزانية التفكير
تُفوتر آثار الاستدلال كرموز مخرجة، وهي أغلى من رموز الإدخال. لذلك لا تستخدم أقصى جهد تفكير لمسار تصنيف بسيط.
استخدم إعدادًا منخفضًا أو دون تفكير للمهام الميكانيكية، واحجز التفكير العميق لحلقات الوكلاء والتحليل الذي يحقق فائدة قابلة للقياس.
الخطوة 4: انقل الأعمال الدفعية إلى خارج الذروة
يُعد التسعير خارج الذروة الذي طرحته DeepSeek في منتصف يوليو وسيلة مباشرة لتقليل تكلفة الأعمال غير التفاعلية. راجع الفترات والخصومات الحالية في وثائق واجهة برمجة التطبيقات DeepSeek قبل جدولة المهام.
أمثلة على الأعمال المناسبة:
- تقييمات ليلية.
- إعادة إنشاء التضمينات.
- تصنيف مجموعات البيانات.
- اختبارات انحدار المطالبات في CI.
- عمليات المعالجة التي لا ينتظر نتيجتها مستخدم.
بدلًا من تنفيذ هذه المهام عند الطلب، ضعها في قائمة انتظار مع نافذة تشغيل:
from datetime import datetime, timezone
def enqueue_batch(job):
job.release_after = next_off_peak_window()
queue.publish("llm-batch", job)
غيّر الجدولة فقط عندما تكون الرموز والمدخلات متطابقة ولا تتطلب المهمة استجابة فورية.
تنبيه: لم توضح DeepSeek ما إذا كانت فروقات خارج الذروة ستستمر بعد الزيادة. استفد منها الآن، وأعد التحقق من الشروط عند نشر الأسعار الجديدة.
تقدير الفاتورة عند زيادات 1.5x و2x و3x
هذه سيناريوهات توضيحية وليست توقعات. لم تعلن DeepSeek مضاعفًا محددًا، ولا نعرف ما إذا كانت جميع المستويات ستتغير بالتساوي. يفترض الحساب التالي زيادة موحدة.
حمل العمل الافتراضي
شهريًا:
- V4-Pro: 400 مليون رمز إدخال، بمعدل مطابقة 60%، و60 مليون رمز إخراج.
- عدم المطابقة: $69.60
- المطابقة: $0.87
- المخرجات: $52.20
- الإجمالي: $122.67
- V4-Flash: 600 مليون رمز إدخال و120 مليون رمز إخراج.
- المدخلات: $84.00
- المخرجات: $33.60
- الإجمالي: $117.60
الفاتورة الأساسية: $240.27.
في السيناريو المحسن، ترفع إعادة هيكلة البادئة معدل مطابقة Pro إلى 85%، وتخفض ميزانية التفكير مخرجات Pro إلى 45 مليون رمز. تصبح فاتورة Pro نحو $66.48، وتصبح الفاتورة الكلية $184.08.
| سيناريو السعر | الفاتورة غير المحسّنة | الفاتورة المحسّنة — الخطوتان 2 و3 |
|---|---|---|
| الأسعار الحالية | $240 | $184 |
| زيادة 1.5x | $360 | $276 |
| زيادة 2x | $481 | $368 |
| زيادة 3x | $721 | $552 |
الحمل المحسن عند زيادة 2x يكلف نحو $368، أي قريبًا من تكلفة الحمل غير المحسن عند زيادة 1.5x، وهي $360. وبما أن التخفيضات الهيكلية تتناسب مع أي مضاعف، فإن خفض الفاتورة بنسبة 23% يوفر نحو $56 اليوم و$168 في سيناريو 3x.
لم تُدرج وفورات خارج الذروة في الجدول لأن قيمتها تعتمد على وقت التشغيل الفعلي؛ لذلك يُعد العمود المحسن تقديرًا محافظًا.
متى يصبح تبديل النماذج أفضل من التحسين؟
حتى سيناريو الزيادة 3x يبقي DeepSeek منخفض التكلفة نسبيًا: يصبح إخراج V4-Pro نحو $2.61 لكل مليون رمز، بينما تضع بعض المقارنات العامة إخراج النماذج المنافسة الرائدة عند $25–30 لكل مليون رمز. يشير eWeek إلى أن الزيادة قد تضعف الميزة السعرية، لكنها لا تلغيها بالضرورة.
ابقَ على DeepSeek عندما
- يجتاز النموذج تقييمات الجودة لديك.
- يتركز إنفاقك في حركة مرور قابلة للتخزين المؤقت.
- تستطيع توجيه المهام البسيطة إلى V4-Flash.
- لديك وقت هندسي لتحسين المطالبات قبل سريان الأسعار.
بدّل النموذج أو قسّم حركة المرور عندما
- تكون كل طلباتك فريدة، ولا تستطيع إعادة استخدام بادئة ثابتة.
- تدفع تكلفة V4-Pro لمهام يجتازها نموذج منافس أصغر.
- يتجاوز مضاعف الزيادة عتبة نقطة التعادل التي حسبتها من بياناتك.
- يفشل النموذج الاحتياطي أو البديل في اختبارات الجودة أو التوافق.
بالنسبة لمعظم الفرق، سيكون الحل الهجين عمليًا: احتفظ بـDeepSeek في المسارات التي يحقق فيها أفضل تكلفة مقابل جودة، وانقل المسارات الأخرى إلى مزود بديل. شغّل مجموعة تكافؤ مشتركة باستمرار حتى تصبح أي زيادة مستقبلية تغييرًا في الإعدادات، لا أزمة تشغيلية.
الخلاصة
أعلنت DeepSeek أن أسعار API سترتفع، لكنها لم تحدد مقدار الزيادة أو موعدها. أفضل استجابة هي استخدام الفترة الحالية لقياس الإنفاق وتحسينه:
- اربط كل استدعاء بالميزة والنموذج وعدد الرموز.
- ثبّت بادئات المطالبات لرفع معدل التخزين المؤقت.
- وجّه المهام البسيطة إلى V4-Flash، واستخدم V4-Pro عند الحاجة.
- خفّض ميزانيات التفكير للمسارات التي لا تحتاج إلى استدلال عميق.
- انقل الأعمال الدفعية إلى خارج الذروة.
- اختبر مزودًا ثانيًا قبل أن تحتاج إلى التحويل الفعلي.
معالجة هذه الخطوات في خدمة واحدة قد تقلل أثر الزيادة بشكل كبير. يمكنك تنزيل Apidog مجانًا، وبناء مجموعة الاختبار مرة واحدة، ثم تشغيلها ضد api.deepseek.com والمزود الاحتياطي باستخدام بيئة منفصلة لكل مزود. جدولة الاختبارات دوريًا تساعدك على التحقق من الجودة والتوافق مع تغيّر الأسعار.
Top comments (0)