يكلف Gemini 3.6 Flash مبلغ 1.50 دولار لكل مليون رمز إدخال و7.50 دولار لكل مليون رمز إخراج. وهو أرخص من النموذج الذي يحل محله. أطلقت جوجل التحديث في 21 يوليو 2026، والخلاصة لمن يراقب فاتورة Gemini API بسيطة: أصبحت فئة Flash الأساسية أسرع وأقل تكلفة في الوقت نفسه.
يوضح هذا الدليل الأرقام اللازمة للتخطيط للميزانية: أسعار الرموز، وتكلفة التخزين المؤقت للسياق، وحدود الفئة المجانية، وطريقة عملية لتقدير الإنفاق الشهري قبل كتابة أي كود. تستند الأرقام إلى وثائق تسعير Gemini API الخاصة بجوجل وإعلان الإطلاق. للحصول على نظرة عامة عن النموذج، اقرأ ما هو Gemini 3.6 Flash.
ملاحظة حول التسمية: انتقلت الفئة الرئيسية إلى Gemini 3.6، بينما بقيت الفئة الأرخص Flash-Lite عند الإصدار 3.5. انتبه لهذا الفرق عند مقارنة الأسعار أو اختيار اسم النموذج في تطبيقك.
لمحة سريعة عن تسعير Gemini 3.6 Flash
| البند | التكلفة |
|---|---|
| الإدخال | 1.50 دولار لكل مليون رمز |
| الإخراج، بما فيه رموز التفكير | 7.50 دولار لكل مليون رمز |
| قراءة إدخال مخزن مؤقتًا | 0.15 دولار لكل مليون رمز |
| تخزين السياق المؤقت | 1.00 دولار لكل مليون رمز في الساعة |
| الفئة المجانية | نعم، عبر Google AI Studio ومحدودة المعدل |
هناك نقطتان مهمتان عند حساب التكلفة:
- رموز التفكير تدخل ضمن تكلفة الإخراج. لا يوجد بند منفصل للتفكير؛ كل الرموز التي ينتجها النموذج قبل الإجابة النهائية تُحاسب بسعر 7.50 دولار لكل مليون رمز.
- التخزين المؤقت له تكلفة قراءة وتكلفة احتفاظ. قراءة السياق المخزن مؤقتًا أرخص بكثير، لكنك تدفع رسوم تخزين لكل ساعة يبقى فيها السياق نشطًا. لذلك، استخدمه عندما تعيد استخدام نفس بادئة الطلب عدة مرات خلال فترة قصيرة.
مقارنة Gemini 3.6 Flash مع Gemini 3.5 Flash
انخفض سعر الإخراج من 9.00 دولارات لكل مليون رمز في Gemini 3.5 Flash إلى 7.50 دولارات في Gemini 3.6 Flash. أي انخفاض يقارب 17% لكل رمز إخراج.
لكن التوفير لا يأتي من السعر وحده. وفقًا لما تعرضه جوجل في صفحة نموذج DeepMind Flash، ينتج Gemini 3.6 Flash نحو 17% رموز إخراج أقل للمهمة نفسها. كما يستدل بخطوات أقل ويجري استدعاءات أدوات أقل في مهام العمل متعددة الخطوات.
عمليًا، لديك عاملان للتوفير:
- تكلفة أقل لكل رمز إخراج.
- عدد أقل من رموز الإخراج.
إذا كنت تضع ميزانية مقارنةً بالنموذج السابق، راجع تفاصيل تسعير Gemini 3.5 Flash إلى جانب هذا الدليل. وللمقارنة الأوسع، راجع Gemini 3.6 Flash مقابل 3.5 Flash.
ما تقدمه الفئة المجانية
توجد فئة مجانية متاحة عبر Google AI Studio. يمكنك استدعاء Gemini 3.6 Flash وإنشاء نموذج أولي دون بطاقة ائتمان.
لكن استخدمها للغرض المناسب:
- مناسبة للنماذج الأولية والاختبار الخفيف.
- محدودة المعدل، لذلك ليست مناسبة لحركة مرور الإنتاج.
- قد تستخدم جوجل بيانات الفئة المجانية لتحسين منتجاتها.
- لا تستخدمها مع بيانات العملاء أو البيانات الحساسة أو الملكية.
عند الانتقال إلى منتج فعلي، استخدم مفتاح API مدفوعًا. راجع كيفية استخدام Gemini 3.6 Flash مجانًا لإعداد الفئة المجانية وفهم حدودها.
مثال عملي لحساب التكلفة
لنفترض أنك تشغل وكيلًا يعتمد على الاسترجاع ويستهلك يوميًا:
- 2 مليون رمز إدخال
- 500 ألف رمز إخراج
يمكن حساب التكلفة اليومية كالتالي:
تكلفة الإدخال = (2,000,000 / 1,000,000) × 1.50 = 3.00 دولار
تكلفة الإخراج = (500,000 / 1,000,000) × 7.50 = 3.75 دولار
الإجمالي اليومي = 6.75 دولار
وعلى مدار 30 يومًا:
6.75 × 30 = 202.50 دولار شهريًا
مقارنة تكلفة الإخراج مع Gemini 3.5 Flash
لنفترض أن المهمة نفسها كانت تنتج 600 ألف رمز إخراج على Gemini 3.5 Flash، ثم انخفضت إلى نحو 500 ألف رمز على Gemini 3.6 Flash بسبب تقليل الرموز بنسبة 17%.
| النموذج | رموز الإخراج اليومية | سعر المليون | التكلفة اليومية |
|---|---|---|---|
| Gemini 3.5 Flash | 600,000 | 9.00 دولارات | 5.40 دولارات |
| Gemini 3.6 Flash | 500,000 | 7.50 دولارات | 3.75 دولارات |
التوفير في الإخراج وحده:
5.40 - 3.75 = 1.65 دولار يوميًا
1.65 × 30 = 49.50 دولار شهريًا
أي أن فاتورة الإخراج تنخفض بنحو 31% في هذا المثال. السبب هو تراكم تخفيض السعر مع تخفيض عدد الرموز.
Flash-Lite أرخص حتى
إذا كانت مهمتك بسيطة وعالية الحجم، ففكر في Gemini 3.5 Flash-Lite:
| البند | التكلفة |
|---|---|
| الإدخال | 0.30 دولار لكل مليون رمز |
| الإخراج | 2.50 دولار لكل مليون رمز |
| قراءة الإدخال المخزن مؤقتًا | 0.03 دولار لكل مليون رمز |
| تخزين السياق المؤقت | 1.00 دولار لكل مليون رمز في الساعة |
يعمل Flash-Lite بسرعة أيضًا، بنحو 350 رمز إخراج في الثانية.
لنفس حجم العمل السابق — مليونا رمز إدخال و500 ألف رمز إخراج يوميًا — تكون التكلفة:
الإدخال = 2 × 0.30 = 0.60 دولار
الإخراج = 0.5 × 2.50 = 1.25 دولار
الإجمالي اليومي = 1.85 دولار
الإجمالي الشهري = 55.50 دولار تقريبًا
هذا أرخص بنحو 70% من Gemini 3.6 Flash لنفس عدد الرموز، لكنه ليس بديلًا مطابقًا له. استخدم Flash-Lite في مهام مثل:
- التصنيف
- استخراج الحقول المنظمة
- التوجيه
- الردود القصيرة المنظمة
- المعالجة عالية الحجم ومنخفضة التعقيد
واحتفظ بـ Gemini 3.6 Flash لمهام التفكير الأكثر صعوبة أو التدفقات متعددة الخطوات. اقرأ ما هو Gemini 3.5 Flash-Lite ثم Gemini 3.5 Flash-Lite مقابل 3.6 Flash لتحديد النموذج المناسب لكل مسار.
كيفية التحكم في تكاليفك وقياسها
استخدم هذه الخطوات الأربع لتقليل الفاتورة ومراقبتها.
1. خزّن السياق المتكرر مؤقتًا
إذا كانت كل طلباتك تبدأ بمطالبة نظام طويلة أو بالمستندات المرجعية نفسها، فالتخزين المؤقت يقلل تكلفة قراءة الرموز من 1.50 دولار إلى 0.15 دولار لكل مليون رمز.
لكن احسب رسوم التخزين أيضًا:
التوفير مفيد عندما:
عدد مرات إعادة استخدام السياق × فرق سعر القراءة > رسوم التخزين بالساعة
لا تنشئ ذاكرة مؤقتة لسياق سيُستخدم مرة واحدة فقط.
2. قلّص المطالبات وحدد الإخراج
الإخراج أغلى بخمسة أضعاف من الإدخال، لذلك ضع حدًا واضحًا للإجابات. راجع مطالباتك وابحث عن:
- تعليمات مكررة في كل طلب.
- أمثلة طويلة لا تؤثر في الجودة.
- مستندات كاملة يمكن تلخيصها أو استرجاع أجزاء منها فقط.
- غياب حد أقصى لرموز الإخراج.
3. وجّه المهام البسيطة إلى Flash-Lite
بدل تشغيل كل المهام على نموذج واحد، طبّق توجيهًا بسيطًا:
تصنيف أو استخراج بسيط؟ → Flash-Lite
تلخيص أو رد قصير منظم؟ → Flash-Lite
تفكير متعدد الخطوات؟ → Gemini 3.6 Flash
استدعاءات أدوات معقدة؟ → Gemini 3.6 Flash
هذا التوجيه المختلط غالبًا أقل تكلفة من استخدام Gemini 3.6 Flash لكل طلب.
4. راقب usageMetadata في كل استجابة
لا تعتمد على تقديرات طول المطالبة فقط. تعرض استجابة Gemini حقل usageMetadata الذي يوضح استهلاك الرموز الفعلي لكل طلب.
راقب حقولًا مثل:
{
"usageMetadata": {
"promptTokenCount": 0,
"candidatesTokenCount": 0,
"totalTokenCount": 0
}
}
استخدم هذه البيانات لتسجيل التكلفة الفعلية لكل مسار في تطبيقك. مثال لحساب تقريبي في JavaScript:
function estimateCost({ promptTokens, outputTokens }) {
const inputCost = (promptTokens / 1_000_000) * 1.5;
const outputCost = (outputTokens / 1_000_000) * 7.5;
return {
inputCost,
outputCost,
totalCost: inputCost + outputCost,
};
}
يمكنك اختبار الطلبات الحقيقية ومراجعة usageMetadata باستخدام Apidog. أنشئ طلب POST إلى Gemini API، واحفظ المفتاح في متغير بيئة، ثم اختبر مطالباتك الفعلية بدل الاعتماد على تقديرات نظرية.
لمنع ارتفاع التكلفة دون ملاحظة، أضف اختبارات تتحقق من سقف رموز الإخراج. وإذا تضاعف الاستهلاك بعد تعديل مطالبة، يجب أن يفشل الاختبار قبل أن تتضاعف الفاتورة. يمكنك أيضًا جدولة اختبارات API لاكتشاف تراجعات التكلفة مبكرًا. نزّل Apidog وجرّب نقطة نهاية Gemini قبل ربطها بالإنتاج.
الأسئلة الشائعة
كم يكلف Gemini 3.6 Flash لكل مليون رمز؟
1.50 دولار للإدخال و7.50 دولار للإخراج. تبلغ تكلفة قراءة السياق المخزن مؤقتًا 0.15 دولار لكل مليون رمز، مع رسوم تخزين تبلغ 1.00 دولار لكل مليون رمز في الساعة.
هل يشمل سعر الإخراج رموز التفكير؟
نعم. تُحسب رموز التفكير ضمن سعر الإخراج البالغ 7.50 دولار لكل مليون رمز. لا توجد رسوم منفصلة، لكن زيادة التفكير تعني زيادة عدد رموز الإخراج والفاتورة.
هل توجد فئة مجانية فعلًا؟
نعم، عبر Google AI Studio، لكنها محدودة المعدل ومناسبة للنماذج الأولية والاختبار فقط. لا تستخدمها للبيانات الحساسة أو في بيئات الإنتاج.
هل Gemini 3.6 Flash أرخص من Gemini 3.5 Flash؟
نعم. انخفض سعر الإخراج من 9.00 دولارات إلى 7.50 دولارات لكل مليون رمز، كما يستخدم Gemini 3.6 Flash نحو 17% رموز إخراج أقل للمهمة نفسها. في المثال السابق، يؤدي ذلك إلى تخفيض فعلي يقارب 31% في تكلفة الإخراج.
متى أستخدم Flash-Lite بدلًا من Gemini 3.6 Flash؟
استخدمه عندما تكون المهمة بسيطة والحجم مرتفعًا، مثل التصنيف والاستخراج والتوجيه. بسعر 0.30 دولار للإدخال و2.50 دولار للإخراج، يكون أرخص بنحو 70% لنفس عدد الرموز، بينما يبقى Gemini 3.6 Flash مناسبًا أكثر للتفكير المعقد.
Gemini 3.6 Flash هو تحديث تسعير نادر: انخفض السعر وتحسن النموذج في الوقت نفسه. خطط لميزانيتك على أساس 1.50 دولار للإدخال و7.50 دولار للإخراج، واحسب رموز التفكير ضمن الإخراج، واستخدم التخزين المؤقت وتوجيه المهام إلى Flash-Lite لتقليل التكلفة أكثر.
للسياق التاريخي، راجع تحليل تكلفة Gemini 3.0 API. ثم قِس استدعاءاتك الحقيقية في Apidog لضمان أن أعداد الرموز التي خططت لها هي نفسها التي تدفع مقابلها فعليًا.
Top comments (0)