DEV Community

Cover image for مقارنة جيميني 3.8 فلاش بـ 3.7 فلاش: أهم الاختلافات وهل يستحق الترقية؟
Yusuf Khalidd
Yusuf Khalidd

Posted on Originally published at apidog.com

مقارنة جيميني 3.8 فلاش بـ 3.7 فلاش: أهم الاختلافات وهل يستحق الترقية؟

Gemini 3.8 Flash مقابل 3.7 Flash: ما الذي تحسن وما الذي ستدفعه؟

أطلقت جوجل نموذج Gemini 3.8 Flash في 2 سبتمبر 2026، بعد ثلاثة أسابيع من Gemini 3.7 Flash وستة أسابيع من 3.6 Flash. يحتفظ النموذج بسعر الإطلاق نفسه: 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج حتى 31 ديسمبر، وبسياق يبلغ مليون رمز تقريبًا وبسرعة مماثلة. لكن طريقة عمله تغيرت: خطوات استدلال أصغر، والتحقق من المخرجات، واستدعاء الأدوات في حلقات متكررة. النتيجة أداء معياري أفضل، مقابل استهلاك رموز أعلى.

جرّب Apidog اليوم

لذلك لا يقتصر قرار الترقية على سؤال: «هل 3.8 Flash أفضل؟». نعم، نظريًا هو أفضل. السؤال العملي هو: هل تستحق الجودة الإضافية الرموز الإضافية في عبء عملك؟ وهل تؤثر التغييرات الجذرية في شيفرتك؟

تقول جوجل إن Gemini 3.7 Flash «لا يزال مدعومًا بالكامل»، ولم تنشر تاريخًا لإيقافه. لا توجد حاجة ملحّة للترقية.

مقارنة سريعة

الخاصية Gemini 3.8 Flash Gemini 3.7 Flash
معرّف النموذج gemini-3.8-flash gemini-3.7-flash
تاريخ الإصدار 2 سبتمبر 2026 13 أغسطس 2026
الأساس مبني على Gemini 3.7 Flash وفق بطاقة النموذج غير متوفر
السياق / الحد الأقصى للإخراج 1,048,576 / 65,536 رمزًا نفسه
سعر الإدخال حتى 31 ديسمبر 0.75 دولار لكل مليون رمز 0.75 دولار لكل مليون رمز
سعر الإخراج حتى 31 ديسمبر 3.75 دولار لكل مليون، شامل التفكير 3.75 دولار لكل مليون، شامل التفكير
السعر القياسي من 1 يناير 2027 1.50 / 7.50 دولار 1.50 / 7.50 دولار
قراءة ذاكرة التخزين المؤقت 0.075 دولار لكل مليون رمز نفسه
الدفعة خصم 50%، مع مستويات الرموز نفسها نفسه
مستويات التفكير low، medium افتراضيًا، high low، medium، high
مستوى minimal خطأ في التحقق مقبول؛ توصي جوجل بربطه بـ low عند الترحيل
تاريخ قطع المعرفة مارس 2026 لم يُذكر مجددًا في وثائق 3.8
سرعة الإخراج نحو 300 رمز/ثانية؛ 302.1 في اختبار Artificial Analysis عند high «نفس السرعة تقريبًا» وفق جوجل
مؤشر ذكاء Artificial Analysis 59 عند high 56 عند high
حالة الدعم حالي مدعوم بالكامل، دون تاريخ إيقاف

ما لم يتغير

الأسعار

يبقى سعر الرموز كما هو: 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و7.50 دولار من 1 يناير 2027.

كما لم تتغير:

  • أسعار قراءة التخزين المؤقت.
  • خصم الدفعات.
  • 5000 طلب مجاني شهريًا لميزة تأسيس بحث جوجل، مشتركة بين نماذج Gemini 3.x.

السياق والأنماط

يقبل النموذجان 1,048,576 رمز إدخال و65,536 رمز إخراج. كما يدعمان النص والصورة والفيديو والصوت وPDF كإدخال، والنص كإخراج.

لا يدعم أي منهما:

  • توليد الصوت.
  • توليد الصور.
  • واجهة Live API المباشرة.

السرعة

وصفت جوجل Gemini 3.8 Flash بأنه «بنفس سعر 3.7 وبنفس السرعة تقريبًا». قاست Artificial Analysis سرعة إخراج قدرها 302.1 رمزًا في الثانية عند مستوى التفكير high.

لكن سرعة الكتابة لا تساوي زمن إنجاز المهمة. بلغ وقت الوصول إلى أول رمز 13.30 ثانية في الاختبار نفسه، لأن النموذج يستدل أولًا قبل بدء الإخراج.

واجهة API

تُعد Interactions API المسار الأساسي لنماذج Gemini 3.x، بينما تظل نقطة النهاية القديمة generateContent مدعومة بالكامل دون تاريخ إيقاف.

في معظم الحالات، تعمل شيفرة 3.7 Flash على 3.8 بعد استبدال سلسلة النموذج فقط، باستثناء التغييرات الجذرية التالية.

ما الذي تحسن؟

صممت جوجل 3.8 Flash ليكون «نموذج Flash الأكثر ذكاءً» لمهام هندسة البرمجيات طويلة الأفق، والوكلاء المستقلين، وسير العمل المؤسسي المعقد.

في المهام الصعبة، ينفذ النموذج خطوات استدلال إضافية، ويستدعي الأدوات بشكل متكرر، ويتحقق من عمله أثناء التنفيذ.

نتائج جوجل

المقياس المعياري 3.8 Flash 3.7 Flash الفرق
وكيل Vals Finance v2 61.4% 59.0% +2.4
HLE-Verified 54.9% 53.6% +1.3
مقياس Harvey Legal Agent 10.0% 8.8% +1.2

المكاسب متواضعة لكنها متسقة. كما يتفوق 3.8 Flash في الصفوف الثلاثة على نماذج أكبر في جداول جوجل، مثل Claude Opus 5 الذي سجل 58.6% في Vals Finance و54.4% في HLE-Verified. وتتابع المقارنة الثلاثية مع Claude Fable 5.1 وGPT-5.6 Sol الاتجاه نفسه.

نتائج Artificial Analysis

رفعت Artificial Analysis مؤشر الذكاء الخاص بـ 3.8 Flash إلى 59 عند مستوى high، مقارنةً بـ56 لـ3.7 Flash و52 لـ3.6 Flash.

يربط ذلك النموذج بـ:

  • GPT-5.6 Sol عند xhigh.
  • Grok 4.6 عند medium.
  • نقطة واحدة فوق Claude Fable 5.1 عند medium.

وفي اختبار استخدام الأدوات τ³-Banking، سجل 3.8 Flash نسبة 45%، بزيادة 12 نقطة عن 3.7 Flash. هذه النتيجة أكثر أهمية من مؤشر الذكاء العام إذا كانت تطبيقاتك تستخدم وكلاء واستدعاءات أدوات فعلية.

سير العمل الطويلة وكثيفة المستندات

تقول جوجل إن 3.8 Flash يُكمل أكثر من ثلاثة أضعاف عدد المهام التي يُكملها 3.7 Flash في سير العمل الطويلة وكثيفة المستندات.

هذا تقييم داخلي ولا توجد منه بيئة اختبار عامة، لذلك ينبغي اعتباره مؤشرًا اتجاهيًا. لكنه يتوافق مع تصميم النموذج: التحقق المتكرر مفيد خصوصًا في مهمة من 40 خطوة قد يفشل فيها التنفيذ بالكامل بسبب خطأ واحد.

الترميز

سجل 3.7 Flash نسبة 65.3% في DeepSWE v1.1، مقارنةً بـ49.0% لـ3.6 Flash. وتقول جوجل إن 3.8 Flash يتفوق على معظم النماذج الحدودية الأكبر في هذا الاختبار بجزء بسيط من التكلفة.

لكن النسبة الدقيقة لـ3.8 Flash تظهر في جداول الصور داخل بطاقة النموذج فقط، وليس في النص المنشور، لذلك لا نطبع رقمًا غير موثق هنا. كما لم تُنشر في النص أرقام 3.8 Flash الخاصة بـSWE-Bench Pro أو Terminal-bench أو OSWorld. إذا كانت هذه المقاييس حاسمة لقرارك، فانتظر نتائج من طرف ثالث أو اختبر مستودعك مباشرة.

السلامة ومقاومة الحقن

تفيد جوجل بوجود «قفزة كبيرة» في اختبار حقن الأوامر Gray Swan، دون نشر رقم محدد.

أما الفروقات في بطاقة النموذج مقارنةً بـ3.7 Flash فهي:

  • السلامة متعددة اللغات: +5.4 نقطة.
  • سلامة النص إلى النص: -0.4 نقطة.
  • الرفض غير المبرر: +1.1 نقطة.

تعني النتيجة الأخيرة زيادة طفيفة في الرفض المفرط.

ما الذي سيكلفك؟

لم تتغير أسعار الرموز، لكن تكلفة المهمة ارتفعت. توضح جوجل أن النموذج قد يستخدم رموزًا أكثر في المهام الأطول والأكثر تعقيدًا، خصوصًا عند مستويات التفكير الأعلى.

قاست Artificial Analysis متوسط 48,000 رمز إخراج لكل مهمة في 3.8 Flash، بزيادة 30% عن 3.7 Flash:

التكوين التكلفة لكل مهمة الوقت لكل مهمة
Gemini 3.7 Flash، high 0.40 دولار 2.2 دقيقة
Gemini 3.8 Flash، low 0.24 دولار 0.8 دقيقة
Gemini 3.8 Flash، medium 0.41 دولار لم تُنشر
Gemini 3.8 Flash، high 0.58 دولار 2.5 دقيقة

توضح النتائج ثلاث نقاط:

  1. يكلف 3.8 Flash عند high نحو 45% أكثر لكل مهمة من 3.7 Flash عند high، ويستغرق وقتًا أطول بنحو 14%.
  2. يكلف 3.8 Flash عند medium نحو 0.41 دولار، أي بفارق سنت واحد تقريبًا عن 3.7 Flash عند high.
  3. يقدم 3.8 Flash عند low أقل تكلفة وأسرع زمن في الجدول، وهو مناسب للمسارات الحساسة للكمون التي تستخدم high في 3.7 Flash بدافع الإعدادات الافتراضية أو العادة.

الخلاصة: الترقية ليست مجانية عند القياس لكل مهمة، ومستوى التفكير هو الأداة الأساسية لتحديد مقدار التحسين الذي تشتريه.

التغييرات الجذرية

1. لم يعد minimal مقبولًا

يعيد الإعداد التالي خطأ تحقق في 3.8 Flash:

{
  "thinking_level": "minimal"
}
Enter fullscreen mode Exit fullscreen mode

يقبل 3.8 Flash المستويات low وmedium وhigh فقط. حوّل أي إعداد قديم يستخدم minimal إلى low.

2. يجب تضمين call_id وname

تحتاج كل استجابة function_result في Interactions API إلى الحقلين call_id وname.

وفي نقطة النهاية القديمة generateContent، يجب أن يتضمن كل functionResponse:

  • id المطابق.
  • name.

ستفشل الشيفرة التي تعيد بناء نتائج الوظائف بالاعتماد على الاسم فقط عند الدورة الثانية من حلقة الأدوات.

قواعد ترحيل إضافية

أعد التحقق من القواعد التالية أثناء الترحيل:

  • أبقِ temperature عند القيمة الافتراضية 1.0. تحذر جوجل من أن القيم الأقل قد تسبب حلقات أو أداءً متدهورًا.
  • استخدم thinking_level بدلًا من thinking_budget كعدد صحيح.
  • أسقط candidate_count.
  • مرر توقيعات التفكير مرة أخرى كما استلمتها بالضبط.

ليست هذه القواعد جديدة على 3.8، لكنها قد تكشف مشكلات في شيفرة 3.7 التي كانت تتجاهلها.

مصفوفة القرار حسب عبء العمل

عبء العمل التوصية السبب
وكلاء متعددو الخطوات مع استدعاءات الأدوات الترقية إلى medium أو high +12 في τ³-Banking؛ حلقات الأدوات المتكررة هي جوهر 3.8
استخراج ومراجعة المستندات الطويلة الترقية ادعاء إنجاز المهام بمعدل 3x يستهدف هذا السيناريو
الترميز الآلي في بيئة اختبار الترقية ثم القياس لم تُنشر النسبة النصية لـDeepSWE؛ اختبر مستودعك
وكلاء المالية والقانون والبحث الترقية جميع جداول جوجل المنشورة تميل إلى 3.8
التصنيف والاستخراج والدردشة عالية الحجم البقاء على 3.7 أو استخدام 3.8 عند low تكلفة المهمة أهم؛ low أرخص من 3.7 عند high
نقاط النهاية الحساسة للكمون 3.8 عند low 0.8 دقيقة لكل مهمة مقابل 2.2 دقيقة لـ3.7 عند high
أي شيء يستخدم minimal الترحيل أولًا سيظهر خطأ تحقق حتى تحويله إلى low
خطوط أنابيب الدفعة المسعّرة حسب الدقة البقاء على 3.7 حتى إعادة القياس السعر لكل رمز لم يتغير، لكن زيادة 30% في رموز الإخراج تغير الفاتورة

القاعدة العملية: كلما كانت المهمة أصعب وأطول، استفاد عبء العمل أكثر من تصميم 3.8 Flash الذي «يعمل بجهد أكبر». وكلما كانت المهمة أقصر وأكثر تكرارًا، أصبح مستوى التفكير أو البقاء على 3.7 أهم.

اختبر النموذجين في Apidog

الأرقام السابقة مأخوذة من بيئة Artificial Analysis، وليست من بيئتك. قبل تغيير النموذج في الإنتاج، قارن النموذجين على طلباتك الفعلية.

الإعداد

  1. عيّن GEMINI_API_KEY كمتغير بيئة في Apidog.
  2. أضف طلب POST إلى:
https://generativelanguage.googleapis.com/v1beta/models/{{model}}:generateContent
Enter fullscreen mode Exit fullscreen mode
  1. أرسل مفتاح API في الترويسة x-goog-api-key، على أن تُقرأ قيمته من متغير البيئة.
  2. اجعل model متغيرًا في السيناريو.
  3. استخدم الجسم نفسه في الاختبارين:
{
  "contents": [
    {
      "parts": [
        {
          "text": "{{golden_prompt}}"
        }
      ]
    }
  ],
  "generationConfig": {
    "thinkingConfig": {
      "thinkingLevel": "medium"
    }
  }
}
Enter fullscreen mode Exit fullscreen mode

سيناريو المقارنة

أنشئ سيناريو من خطوتين:

  1. الطلب نفسه مع model يساوي gemini-3.7-flash.
  2. الطلب نفسه مع model يساوي gemini-3.8-flash.

في كل خطوة، أضف تأكيدات على:

  • usageMetadata.candidatesTokenCount.
  • usageMetadata.thoughtsTokenCount.
  • أي مسار JSON يقرأه تطبيقك.

ضع حدودًا قصوى للتوكنات بما يعكس ميزانيتك، وشغّل السيناريو على مجموعة من 10 أو 20 طلبًا ذهبيًا. يعرض تقرير Apidog الاستجابات ونتائج التأكيد معًا، لتصبح زيادة 30% رقمًا خاصًا بعبء عملك بدلًا من رقم معياري عام.

بعد التأكد من النتائج، قم بجدولة السيناريو بحيث يفشل الاختبار عند أي زيادة غير مقبولة في رموز التفكير بدلًا من اكتشافها في الفاتورة. تغطي الخطة المجانية هذا النوع من سير العمل.

الأسئلة الشائعة

هل Gemini 3.8 Flash أسرع من 3.7 Flash؟

ليس بالضرورة. تصف جوجل السرعة بأنها «مماثلة تقريبًا»، وقاست Artificial Analysis نحو 300 رمز إخراج في الثانية عند high. لكن خطوات الاستدلال الإضافية رفعت زمن المهمة في الاختبار إلى 2.5 دقيقة مقابل 2.2 دقيقة لـ3.7 Flash عند high. عند استخدام low، انخفض الزمن إلى 0.8 دقيقة.

هل يكلف Gemini 3.8 Flash أكثر من 3.7 Flash؟

ليس لكل رمز. السعر نفسه: 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و7.50 دولار.

أما لكل مهمة، فنعم. قدرت Artificial Analysis التكلفة بـ0.58 دولار لـ3.8 Flash عند high مقابل 0.40 دولار لـ3.7 Flash عند high، لأن 3.8 Flash يكتب نحو 30% من الرموز الإضافية.

هل ستوقف جوجل Gemini 3.7 Flash؟

تقول جوجل إن 3.7 Flash «لا يزال مدعومًا بالكامل»، ولم تنشر تاريخًا لإيقافه. يمكنك الاستمرار في استخدامه.

ما الذي سيتعطل عند التبديل إلى 3.8 Flash؟

تغييران أساسيان:

  • thinking_level: "minimal" يعيد خطأ 400 INVALID_ARGUMENT.
  • يجب أن تتضمن استجابات الوظائف معرّف الاستدعاء واسم الوظيفة: call_id في Interactions API، وid في generateContent القديمة، إلى جانب name.

بقية Gemini 3 API لم تتغير وفق دليل الترحيل.

كيف تقارن هذه القفزة بالانتقال من 3.6 إلى 3.7؟

كانت قفزة 3.7 أكبر في بعض المقاييس: ارتفع DeepSWE من 49.0% إلى 65.3%، وارتفع مؤشر Artificial Analysis من 52 إلى 56.

أما 3.8 فقدم زيادة قدرها ثلاث نقاط في المؤشر، مع إعادة تصميم لطريقة استهلاك الرموز والتحقق من النتائج.

الخلاصة

قم بالترقية إذا كان عبء عملك قائمًا على الوكلاء، أو كثيف الأدوات، أو كثيف المستندات؛ فهنا تظهر مكاسب جوجل وArtificial Analysis، وهنا تشتري الرموز الإضافية مهامًا مكتملة.

ابقَ على 3.7 Flash، أو استخدم 3.8 عند مستوى low، إذا كانت تطبيقاتك تعتمد على استدعاءات قصيرة ومتكررة وتهمك تكلفة المهمة أو الكمون.

في كلتا الحالتين:

  1. حوّل minimal إلى low.
  2. أصلح استجابات الوظائف لتتضمن المعرّفات والأسماء المطلوبة.
  3. قِس عدد الرموز على طلباتك الفعلية قبل اعتماد النموذج في الإنتاج.

الروابط والمصادر

Top comments (0)