جوجل حدّثت طبقة Flash في 21 يوليو 2026، ويُعد Gemini 3.5 Flash-Lite الخيار الاقتصادي ضمنها. إنه أرخص وأسرع نموذج Gemini يمكنك استدعاؤه اليوم، ومصمم للمهام عالية الحجم والحساسة للكمون: التصنيف، الاستخراج، الردود القصيرة في الدردشة، وإجابات الاسترجاع البسيطة حيث تكون الإنتاجية والتكلفة أهم من التفكير العميق. إذا كنت ترسل ملايين الطلبات الصغيرة يوميًا، فهذا هو النموذج المناسب لمسارك الساخن.
أطلق التحديث ثلاثة نماذج في وقت واحد. لتجنب الالتباس، ستغطي هذه المقالة تسمية النماذج، المواصفات والتسعير، متى تستخدم Flash-Lite، وكيف تختبر نقطة النهاية في سير عمل عملي.
ما هو Gemini 3.5 Flash-Lite؟
Gemini 3.5 Flash-Lite هو أصغر وأرخص نموذج في عائلة Gemini من Google. تم ضبطه للسرعة والحجم، وليس للتفكير الأعمق. تقدر Google سرعته بحوالي 350 رمزًا إخراجيًا في الثانية، لذلك تبدو الاستجابات فورية تقريبًا حتى تحت الضغط.
استخدم معرف النموذج التالي في Gemini API:
gemini-3.5-flash-lite
استخدمه للمهام المتكررة وعالية التردد، مثل:
- تصنيف تذاكر الدعم.
- استخراج حقول منظمة من مستندات أو نصوص غير منظمة.
- الإجابة عن سؤال قصير اعتمادًا على نص مسترجع.
- تشغيل مساعد دردشة يجب أن يستجيب قبل أن يلاحظ المستخدم أي تأخير.
تم إطلاق النموذج ضمن تحديث Flash يتكون من ثلاثة نماذج:
- Gemini 3.6 Flash: النموذج الرئيسي للاستخدامات العامة.
- Gemini 3.5 Flash-Lite: طبقة منخفضة التكلفة وعالية السرعة.
- Gemini 3.5 Flash Cyber: نموذج أمان محمي.
راجع ملخص Google على مدونة Google وتفاصيل النماذج على صفحة DeepMind Flash. يقع Flash-Lite في أدنى مستوى من حيث السعر وأعلى مستوى من حيث السرعة الخام.
لماذا هو 3.5 وليس 3.6؟
قد يبدو الاسم مربكًا: النموذج الرئيسي الجديد هو Gemini 3.6 Flash، بينما بقي Flash-Lite ونموذج Cyber على تسمية 3.5.
هذا ليس خطأ مطبعيًا. رقم الإصدار يتتبع خط النموذج، وليس تاريخ الإطلاق. حصل النموذج الرئيسي على ترقية جيلية أكبر، لذلك حمل اسم 3.6، بينما حافظ Flash-Lite على خط 3.5.
كذلك، لا تخلط بين Gemini 3.5 Flash-Lite وGemini 3.1 Flash-Lite الأقدم. كلاهما يحمل اسم Flash-Lite، لكنهما نموذجان مختلفان. تحقق دائمًا من معرف النموذج في إعداداتك:
gemini-3.5-flash-lite
المواصفات والتسعير
جميع الأسعار التالية لكل مليون رمز عبر Gemini API:
| السمة | القيمة |
|---|---|
| معرف النموذج | gemini-3.5-flash-lite |
| سعر الإدخال | $0.30 / مليون رمز |
| سعر الإخراج | $2.50 / مليون رمز |
| السرعة | ~350 رمز إخراج/ثانية |
| الطبقة المجانية | نعم، عبر Google AI Studio مع حدود معدل |
| تخزين السياق المؤقت | $0.03 / مليون رمز + $1.00 / مليون/ساعة تخزين |
بسعر $0.30 للإدخال و$2.50 للإخراج، يعد Flash-Lite أرخص خيار منشور ضمن تشكيلة Gemini الحالية. للمقارنة، يبلغ سعر Gemini 3.6 Flash $1.50 للإدخال و$7.50 للإخراج.
عمليًا، هذا يعني أن Flash-Lite يكلف نحو خُمس تكلفة إدخال 3.6 Flash وثلث تكلفة الإخراج تقريبًا. يصبح هذا الفرق مهمًا عند معالجة ملايين الطلبات القصيرة.
تحقق من الأسعار الحالية دائمًا في وثائق تسعير Gemini API، لأن Google تحدث هذه الصفحة مباشرة.
متى تستخدم تخزين السياق المؤقت؟
استخدم التخزين المؤقت عندما تكرر إرسال محتوى ثابت، مثل:
- مطالبة نظام طويلة.
- تعليمات استخراج موحدة.
- مستند مرجعي مشترك بين طلبات كثيرة.
- قاعدة معرفة ثابتة ضمن مجموعة طلبات قصيرة.
ستدفع تكلفة صغيرة للتخزين المؤقت ورسوم تخزين بالساعة، لكن إعادة استخدام الإدخال المخزن مؤقتًا تكون أرخص بكثير من إرساله كاملًا مع كل طلب.
ما مدى جودة أدائه؟
يحقق Gemini 3.5 Flash-Lite نسبة 54% في اختبار Terminal-Bench 2.1، مقارنة بـ31% لسابقه. هذه قفزة مهمة لفئة Lite، وتعني أن النموذج أصبح مناسبًا لمهام كانت تتطلب سابقًا نموذجًا أكبر.
أفضل حالات الاستخدام:
- التصنيف: توجيه الرسائل أو التذاكر إلى فئات محددة.
- الاستخراج: تحويل النص الفوضوي إلى حقول JSON منظمة.
- الردود القصيرة: تشغيل دردشة خفيفة أو إجابات مباشرة.
- RAG البسيط: الإجابة عن سؤال اعتمادًا على مقطع مسترجع ومحدد.
لكن لا تستخدمه افتراضيًا للمهام التالية:
- البرمجة الذكية المعقدة.
- التخطيط متعدد الخطوات.
- سلاسل الأدوات الطويلة.
- الاستدلال العميق على قواعد بيانات أو سياقات معقدة.
لهذه المهام، استخدم Gemini 3.6 Flash أو نموذجًا أكبر. توفير بضعة سنتات لكل مليون رمز لا يفيد إذا كانت الإجابات الخاطئة تتطلب تدخلًا يدويًا مكلفًا.
أين تستخدم Google نموذج Flash-Lite؟
لا تبيع Google Flash-Lite للمطورين فقط، بل تدمجه أيضًا في بحث Google. هذه إشارة عملية إلى أن النموذج مصمم للتعامل مع حجم كبير من الاستعلامات مع الحفاظ على الكمون والتكلفة تحت السيطرة.
بالنسبة لتطبيقك، تنطبق الفكرة نفسها. إذا كان لديك مسار API مزدحم يتعامل مع مهام قصيرة ومتكررة، مثل تصنيف الطلبات أو استخراج البيانات، فـFlash-Lite مناسب لهذا المسار.
Flash-Lite مقابل Gemini 3.6 Flash: أيهما تختار؟
اختر النموذج بناءً على صعوبة المهمة، لا بناءً على اسم الإصدار فقط.
| نوع المهمة | النموذج المقترح |
|---|---|
| تصنيف عالي الحجم | Gemini 3.5 Flash-Lite |
| استخراج JSON من نصوص قصيرة | Gemini 3.5 Flash-Lite |
| ردود دردشة قصيرة | Gemini 3.5 Flash-Lite |
| RAG بسيط | Gemini 3.5 Flash-Lite |
| برمجة معقدة | Gemini 3.6 Flash |
| استدعاءات أدوات متعددة الخطوات | Gemini 3.6 Flash |
| تخطيط أو استدلال عميق | Gemini 3.6 Flash |
نمط تنفيذ عملي هو التوجيه حسب الصعوبة:
- أرسل الطلبات القصيرة والمتكررة إلى Flash-Lite.
- تحقق من مستوى الثقة أو اكتمال المخرجات.
- صعّد الطلبات المعقدة أو غير الواضحة إلى Gemini 3.6 Flash.
- راقب معدل التصعيد والتكلفة والأخطاء بمرور الوقت.
بهذه الطريقة، تحصل على تكلفة منخفضة لمعظم حركة المرور، وتستخدم النموذج الأقوى فقط عندما تستحق المهمة ذلك.
راجع تسعير Gemini 3.6 Flash أو المقارنة الكاملة بين Gemini 3.5 Flash-Lite و3.6 Flash.
كيفية الوصول إليه واختباره
يعمل Flash-Lite عبر Gemini API. للبدء:
- افتح Google AI Studio.
- أنشئ مفتاح API.
- اضبط النموذج على
gemini-3.5-flash-lite. - اختبر الطلبات على الطبقة المجانية قبل إعداد الفوترة.
- انقل أحمال الإنتاج إلى مفتاح API مدفوع.
الطبقة المجانية مقيدة بمعدل، وقد تستخدم Google بياناتها لتحسين منتجاتها. لا ترسل مدخلات حساسة عبر مفتاح الطبقة المجانية.
راجع وثائق Gemini API للتفاصيل الكاملة.
اختبر الاستجابة كجزء من سير عمل API
لا يكفي أن ينجح الطلب مرة واحدة. راقب أيضًا:
- رمز الاستجابة.
- زمن الاستجابة.
- بنية JSON.
- الحقول المطلوبة في المخرجات.
- التغييرات المحتملة في الحدود أو التسعير.
باستخدام Apidog، يمكنك إنشاء طلب POST لنقطة نهاية Gemini، وحفظ مفتاح API كمتغير بيئة بدل وضعه في نص الطلب، ثم إضافة اختبارات للتحقق من رمز الحالة وحقول JSON التي يعتمد عليها تطبيقك.
على سبيل المثال، اجعل اختباراتك تتحقق من:
- أن رمز الحالة هو 200
- أن نص الاستجابة موجود
- أن الاستجابة تطابق البنية المتوقعة
- أن زمن الاستجابة لا يتجاوز الحد الذي تقبله في الإنتاج
بعد ذلك، حوّل الطلب إلى اختبار تراجع وجدوله عبر تشغيل اختبارات API مجدولة. بهذه الطريقة، تكتشف الاستجابات المعطلة أو التغييرات غير المتوقعة قبل أن تصل إلى المستخدمين.
Apidog لا يشغل النموذج ولا يستبدل Gemini API؛ بل يعمل كعميل لاستدعاء نقطة النهاية والتحقق منها ومراقبتها ضمن بقية مكدس API لديك.
الأسئلة الشائعة
هل Gemini 3.5 Flash-Lite هو نفسه Gemini 3.6 Flash؟
لا. هما نموذجان مختلفان من التحديث الصادر في 21 يوليو 2026. Flash-Lite هو النموذج الأرخص والأسرع للمهام البسيطة وعالية الحجم، بينما 3.6 Flash هو النموذج الرئيسي بقدرات أقوى في التفكير والبرمجة.
لماذا هو 3.5 وليس 3.6؟
لأن Google أطلقت إصدارات مختلطة. تم تحديث النموذج الرئيسي Flash إلى 3.6، بينما بقي Flash-Lite ونموذج Cyber على تسمية 3.5. رقم الإصدار يتبع خط النموذج، وليس تاريخ الإطلاق.
هل هذا هو Gemini 3.1 Flash-Lite القديم؟
لا. Gemini 3.5 Flash-Lite نموذج أحدث. يحمل النموذجان اسم العائلة نفسه، لكنهما إصداران مختلفان. تحقق من استخدام المعرف التالي:
gemini-3.5-flash-lite
هل Gemini 3.5 Flash-Lite مجاني؟
توجد طبقة مجانية عبر Google AI Studio، لكنها مقيدة بمعدل. تناسب الاختبار والاستخدام الخفيف، بينما تحتاج أحمال الإنتاج إلى مفتاح API مدفوع.
فيما يتفوق Flash-Lite؟
يتفوق في التصنيف، الاستخراج، الردود القصيرة في الدردشة، وإجابات الاسترجاع البسيطة بكميات كبيرة. ليس الخيار الأفضل للبرمجة المعقدة أو التفكير متعدد الخطوات الطويل، حيث يكون Gemini 3.6 Flash أكثر ملاءمة.


Top comments (0)