تسعير Gemini 3.8 Flash: التكلفة الفعلية ورموز التفكير
تبلغ تكلفة Gemini 3.8 Flash 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج، وهو السعر الافتتاحي نفسه الذي حددته Google لـ 3.7 Flash حتى 31 ديسمبر 2026. في 1 يناير 2027، يتضاعف السعر إلى 1.50 دولار للإدخال و7.50 دولار للإخراج، وينطبق التغيير نفسه على 3.6 Flash و3.7 Flash. لم يتغير سعر الرمز الأساسي مع الإصدار، لكن النموذج يستهلك رموزًا أكثر لكل مهمة.
تقول Google إن Gemini 3.8 Flash «يعمل بجدية أكبر»: يتخذ خطوات تفكير إضافية، ويستدعي الأدوات بصورة متكررة، ويمكنه استخدام رموز أكثر في المهام الطويلة والمعقدة. ووفقًا لقياس مستقل من Artificial Analysis، بلغت تكلفة تشغيل مؤشر الذكاء 0.58 دولار لكل مهمة على 3.8 Flash بمستوى تفكير عالٍ، مقابل 0.40 دولار على 3.7 Flash، مع نحو 30% المزيد من رموز الإخراج.
يعرض هذا الدليل أسعار Gemini API الرسمية، وتكلفة 1000 مهمة يوميًا، ومقارنة مع Flash-Lite وClaude Sonnet 5 وGPT-5.6 Luna. وللتعرّف إلى النموذج أولًا، راجع ما هو Gemini 3.8 Flash.
أسعار Gemini 3.8 Flash سريعًا
الأسعار التالية لكل مليون رمز على المستوى المدفوع:
| السعر | مقدمة (حتى 31 ديسمبر 2026) | قياسي (من 1 يناير 2027) |
|---|---|---|
| الإدخال (نص، صورة، فيديو، صوت، PDF) | $0.75 | $1.50 |
| الإخراج (بما في ذلك رموز التفكير) | $3.75 | $7.50 |
| قراءة ذاكرة التخزين المؤقت للسياق | $0.075 | $0.15 |
| تخزين ذاكرة التخزين المؤقت (لكل مليون رمز/ساعة) | $0.50 | $1.00 |
| إدخال Batch API (خصم 50%) | $0.375 | $0.75 |
| إخراج Batch API (خصم 50%) | $1.875 | $3.75 |
| تأريض بحث Google | 5000 طلب مجاني شهريًا مشترك عبر Gemini 3.x، ثم 14 دولارًا لكل 1000 طلب | نفس الشيء |
| المستوى المجاني | 0 دولار، محدود المعدل، والبيانات مستخدمة لتحسين منتجات Google | نفس الشيء |
النقاط الأهم:
- رموز التفكير تُحاسب كسائر رموز الإخراج بسعر 3.75 دولار، لا بسعر الإدخال.
- السعر الافتتاحي مؤقت وينتهي في 31 ديسمبر 2026.
- تتضاعف أسعار 3.6 Flash و3.7 Flash أيضًا في 1 يناير. راجع تفاصيل تسعير 3.7 Flash.
رموز التفكير تُحسب كإخراج
يُبلغ API عن الاستخدام في usageMetadata داخل استجابة generateContent:
-
thoughtsTokenCount: رموز التفكير -
candidatesTokenCount: الإجابة المرئية -
promptTokenCount: رموز الإدخال
يُحاسب كل من thoughtsTokenCount وcandidatesTokenCount بسعر الإخراج نفسه، وهو 3.75 دولار لكل مليون رمز في الفترة التمهيدية.
يمكن ضبط الجهد عبر thinking_level:
منخفضمتوسطمرتفع
القيمة الافتراضية في 3.8 Flash هي متوسط. أُزيلت minimal وتؤدي إلى خطأ تحقق، لذلك يجب تحديث أي إعداد موروث من نماذج سابقة إلى low. يصف دليل Google للتفكير هذه المستويات باعتبارها جهدًا نسبيًا، لا ميزانية رموز ثابتة؛ لذلك لا يمكن تحديد سقف مباشر لرموز التفكير باستخدام thinking_budget القديم. يشرح دليل مستويات تفكير 3.8 Flash أثر كل مستوى على التكلفة والكمون.
مثال حسابي
لنفترض طلبًا يحتوي على:
- 10,000 رمز إدخال
- 2,000 رمز إخراج مرئي
- 6,000 رمز تفكير
بالأسعار التمهيدية:
- الإدخال:
10,000 × 0.75 / 1,000,000 = 0.0075 دولار - الإخراج:
(2,000 + 6,000) × 3.75 / 1,000,000 = 0.03 دولار - الإجمالي: 0.0375 دولار لكل طلب
يشكل التفكير 75% من تكلفة الإخراج و60% من إجمالي تكلفة الطلب. بعد 1 يناير 2027، يصبح الطلب نفسه:
0.015 + 0.06 = 0.075 دولار
إذًا، عبارة «السعر نفسه مثل 3.7» صحيحة بالنسبة لسعر الرمز، لكنها لا تعني تكلفة المهمة نفسها؛ فعدد الرموز قد ارتفع.
لماذا ترتفع تكلفة المهمة؟
توضح مقالة إطلاق Google أن النموذج ينفذ خطوات تفكير إضافية ويستدعي الأدوات أكثر، ويتحقق من عمله أثناء التنفيذ. في حلقات الوكلاء، يعني ذلك دورات استدعاء أدوات ورموز تفكير أكثر.
لتقليل التكلفة، توصي Google بخفض thinking_level أو البقاء على 3.7 Flash.
قاست Artificial Analysis تسع تقييمات، وسجلت 3.8 Flash بمستوى عالٍ 59 نقطة مقابل 56 نقطة لـ3.7 Flash، مع متوسط يقارب 48,000 رمز إخراج لكل مهمة، أي بزيادة 30% تقريبًا:
| التهيئة | التكلفة لكل مهمة (الأسعار التمهيدية) | الوقت لكل مهمة |
|---|---|---|
| Gemini 3.8 Flash، مرتفع | $0.58 | 2.5 دقيقة |
| Gemini 3.8 Flash، متوسط | $0.41 | لم يُنشر |
| Gemini 3.8 Flash، منخفض | $0.24 | 0.8 دقيقة |
| Gemini 3.7 Flash، مرتفع | $0.40 | 2.2 دقيقة |
عمليًا:
- المستوى المرتفع في 3.8 Flash أغلى 45% لكل مهمة من المستوى المرتفع في 3.7 Flash:
0.58 / 0.40 = 1.45. - الانتقال من مرتفع إلى متوسط في 3.8 Flash يخفض التكلفة 29%:
0.41 / 0.58 = 0.71. - الانتقال إلى منخفض يخفضها 59%:
0.24 / 0.58 = 0.41. - المستوى المتوسط في 3.8 Flash قريب من المستوى المرتفع في 3.7 Flash، بفارق سنت واحد لكل مهمة.
تعرض مقارنة 3.8 Flash و3.7 Flash القرار وفق حجم العمل. وتذكر Artificial Analysis سعرًا مختلطًا قدره 0.58 دولار لكل مليون رمز بنسبة إدخال إلى إخراج 3:1. تطابق هذا الرقم مع تكلفة المهمة عالية المستوى مجرد مصادفة؛ الأول سعر لكل رمز، والثاني يعتمد على عدد الرموز المستخدمة فعليًا.
استفد من السعر الافتتاحي قبل 31 ديسمبر
تحاسب Google الرموز بالسعر الساري وقت استهلاكها، لذلك لا يمكن الدفع مقدمًا لاستخدام 2027 بأسعار 2026. كما أن الانتقال إلى 3.7 أو3.6 Flash لا يلغي الزيادة.
انقل الأعمال التقديرية المناسبة إلى الفترة التمهيدية:
- شغّل عمليات إعادة التعبئة ومعالجة المستندات لمرة واحدة عبر Batch API. دفعة من 100 مليون رمز، تتضمن 75 مليون إدخال و25 مليون إخراج، تكلف هذا العام:
75 × 0.375 + 25 × 1.875 = 74.99 دولار
وستكلف بعد الزيادة 149.98 دولار تقريبًا.
- أنشئ مجموعة تقييم وسجل خط أساس لعدد الرموز قبل تغير الأسعار.
- حدّد مستوى التفكير لكل مسار إنتاجي. اختبر المسارات على
lowواحتفظ بأدنى مستوى ينجح في التقييم. - إذا كان السعر هو العامل الحاسم، راجع أرخص مزودي LLM API ومقارنة Fable 5.1 وGPT-5.6 Sol.
مقارنة Flash-Lite وSonnet 5 وGPT-5.6 Luna
الأسعار لكل مليون رمز:
| النموذج | الإدخال | الإخراج | ملاحظات |
|---|---|---|---|
| Gemini 3.8 Flash (مقدمة) | $0.75 | $3.75 | التفكير يُحسب كإخراج؛ قراءة الذاكرة المؤقتة $0.075 |
| Gemini 3.8 Flash (من 1 يناير) | $1.50 | $7.50 | قراءة الذاكرة المؤقتة $0.15 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | نحو 350 رمزًا/ثانية |
| Claude Sonnet 5 | $2 | $10 | دائم؛ أُلغيت زيادة 1 سبتمبر |
| GPT-5.6 Luna | $1 | $6 |
بالسعر التمهيدي:
- إدخال 3.8 Flash أغلى 2.5 مرة من Flash-Lite.
- إخراجه أغلى 1.5 مرة من Flash-Lite.
- هو أرخص من Sonnet 5 بنحو 2.7 مرة في الإدخال والإخراج.
- وهو أرخص من Luna: 0.75 مقابل 1 دولار للإدخال، و3.75 مقابل 6 دولارات للإخراج.
في 1 يناير 2027، يصبح 3.8 Flash أغلى من Luna في الإدخال والإخراج، ويضيق الفارق مع Sonnet 5 إلى نحو 1.3 مرة. يظل Flash-Lite الأرخص.
تظل مقارنة سعر الرمز غير كافية. قد يكون نموذج بسعر أعلى أقل تكلفة لكل مهمة إذا استخدم رموزًا أقل. شغّل مجموعة المهام نفسها على كل نموذج، ثم قارن بيانات الاستخدام. يشرح دليل Gemini 3.8 Flash API قراءة usageMetadata من Interactions API وgenerateContent القديم.
اكتشف تراجعات التكلفة باستخدام Apidog
قد تكون المشكلة إجابة صحيحة استهلكت بهدوء 40% من الرموز الإضافية بعد تعديل مطالبة أو مستوى تفكير. لا يظهر ذلك غالبًا إلا عند وصول الفاتورة. يعالج Apidog ذلك عبر اختبار عدد الرموز مثل اختبار رمز الحالة.
-
خزّن المفتاح كمتغير بيئة. أنشئ
GEMINI_API_KEYفي بيئة Apidog، واستخدم{{GEMINI_API_KEY}}في رأسx-goog-api-key. -
أرسل مطالبة ذهبية. احفظ طلب POST إلى
https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContentمع مطالبة تمثيلية وthinkingConfig.thinkingLevelصريح لكل مسار إنتاجي. - تحقق من بيانات الاستخدام. أضف اختبارًا يفشل عند تجاوز خط الأساس:
const usage = pm.response.json().usageMetadata;
pm.test("thinking tokens within budget", () => {
pm.expect(usage.thoughtsTokenCount).to.be.below(8000);
});
pm.test("visible output within budget", () => {
pm.expect(usage.candidatesTokenCount).to.be.below(2500);
});
pm.test("request cost within budget", () => {
const cost = usage.promptTokenCount * 0.75 / 1e6
+ (usage.thoughtsTokenCount + usage.candidatesTokenCount) * 3.75 / 1e6;
pm.expect(cost).to.be.below(0.05);
});
- جدول الاختبارات. ضع الطلبات في سيناريو اختبار وشغّلها دوريًا، بحيث تظهر أي قفزة في الاستخدام كاختبار فاشل في اليوم نفسه. يشرح دليل جدولة اختبارات API في Apidog الإعداد.
- قارن المزودين. وجّه نسخة من السيناريو إلى Flash-Lite أو Sonnet 5 أو Luna، وقارن حقول الاستخدام جنبًا إلى جنب. ابدأ عبر تنزيل Apidog؛ وتغطي الخطة المجانية هذا سير العمل.
الأسئلة الشائعة
هل يكلف Gemini 3.8 Flash أكثر من 3.7 Flash؟
لكل رمز، لا. السعر في النموذجين هو 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و7.50 دولار. لكل مهمة، نعم؛ إذ قاست Artificial Analysis تكلفة قدرها 0.58 دولار لمهمة فهرسة على 3.8 Flash بمستوى عالٍ، مقابل 0.40 دولار على 3.7 Flash، بسبب زيادة رموز الإخراج بنحو 30%.
هل تُحسب رموز التفكير بشكل منفصل؟
لا. تُحسب كرموز إخراج بسعر 3.75 دولار لكل مليون رمز خلال الفترة التمهيدية، وتظهر في usageMetadata.thoughtsTokenCount. يمكن التحكم بها بصورة غير مباشرة عبر thinking_level، ولا توجد ميزانية رموز ثابتة في 3.8 Flash. كما أن minimal يعيد خطأ.
هل يوجد مستوى مجاني؟
نعم. لا يفرض AI Studio رسومًا على الإدخال أو الإخراج في المستوى المجاني، مع حدود معدل ظاهرة في AI Studio، وتستخدم Google بياناته لتحسين منتجاتها. يتيح تطبيق Gemini للمستهلك 3.8 Flash لمشتركي AI Pro وUltra. راجع دليل الاستخدام المجاني.
ماذا يحدث في 1 يناير 2027؟
تتضاعف أسعار الإدخال والإخراج وقراءة الذاكرة المؤقتة وتخزينها وBatch API. إذا ظل استهلاك الرموز لكل مهمة ثابتًا، ستتضاعف الفاتورة أيضًا. وتنطبق الزيادة في التاريخ نفسه على 3.6 Flash و3.7 Flash.
أي مستوى تفكير يحافظ على انخفاض التكلفة؟
ابدأ بأرقام Artificial Analysis: 0.24 دولار للمستوى المنخفض، و0.41 دولار للمتوسط، و0.58 دولار للمرتفع لكل مهمة فهرسة. اختبر مجموعة مهامك على المستويات الثلاثة، واحتفظ بأدنى مستوى ينجح، ثم راقب عدد الرموز باستمرار.
ما يجب فعله هذا الأسبوع
سعّر Gemini 3.8 Flash مثل 3.7 Flash، لكنه يستهلك رموزًا أكثر كنموذج أكبر. تعامل مع thinking_level كإعداد تكلفة، وحدده لكل مسار. انقل أعمال Batch المناسبة إلى الفترة التمهيدية قبل 31 ديسمبر، وأنشئ خط أساس لاستخدام الرموز واختبره الآن حتى تكون زيادة يناير تغييرًا متوقعًا لا مفاجأة في الفاتورة.

Top comments (0)