Gemini 3.8 Flash مقابل 3.7 Flash: ما الذي تحسن وما الذي ستدفعه؟
أطلقت جوجل نموذج Gemini 3.8 Flash في 2 سبتمبر 2026، بعد ثلاثة أسابيع من Gemini 3.7 Flash وستة أسابيع من 3.6 Flash. يحتفظ النموذج بسعر الإطلاق نفسه: 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج حتى 31 ديسمبر، وبسياق يبلغ مليون رمز تقريبًا وبسرعة مماثلة. لكن طريقة عمله تغيرت: خطوات استدلال أصغر، والتحقق من المخرجات، واستدعاء الأدوات في حلقات متكررة. النتيجة أداء معياري أفضل، مقابل استهلاك رموز أعلى.
لذلك لا يقتصر قرار الترقية على سؤال: «هل 3.8 Flash أفضل؟». نعم، نظريًا هو أفضل. السؤال العملي هو: هل تستحق الجودة الإضافية الرموز الإضافية في عبء عملك؟ وهل تؤثر التغييرات الجذرية في شيفرتك؟
تقول جوجل إن Gemini 3.7 Flash «لا يزال مدعومًا بالكامل»، ولم تنشر تاريخًا لإيقافه. لا توجد حاجة ملحّة للترقية.
مقارنة سريعة
| الخاصية | Gemini 3.8 Flash | Gemini 3.7 Flash |
|---|---|---|
| معرّف النموذج | gemini-3.8-flash |
gemini-3.7-flash |
| تاريخ الإصدار | 2 سبتمبر 2026 | 13 أغسطس 2026 |
| الأساس | مبني على Gemini 3.7 Flash وفق بطاقة النموذج | غير متوفر |
| السياق / الحد الأقصى للإخراج | 1,048,576 / 65,536 رمزًا | نفسه |
| سعر الإدخال حتى 31 ديسمبر | 0.75 دولار لكل مليون رمز | 0.75 دولار لكل مليون رمز |
| سعر الإخراج حتى 31 ديسمبر | 3.75 دولار لكل مليون، شامل التفكير | 3.75 دولار لكل مليون، شامل التفكير |
| السعر القياسي من 1 يناير 2027 | 1.50 / 7.50 دولار | 1.50 / 7.50 دولار |
| قراءة ذاكرة التخزين المؤقت | 0.075 دولار لكل مليون رمز | نفسه |
| الدفعة | خصم 50%، مع مستويات الرموز نفسها | نفسه |
| مستويات التفكير |
low، medium افتراضيًا، high
|
low، medium، high
|
مستوى minimal
|
خطأ في التحقق | مقبول؛ توصي جوجل بربطه بـ low عند الترحيل |
| تاريخ قطع المعرفة | مارس 2026 | لم يُذكر مجددًا في وثائق 3.8 |
| سرعة الإخراج | نحو 300 رمز/ثانية؛ 302.1 في اختبار Artificial Analysis عند high
|
«نفس السرعة تقريبًا» وفق جوجل |
| مؤشر ذكاء Artificial Analysis | 59 عند high
|
56 عند high
|
| حالة الدعم | حالي | مدعوم بالكامل، دون تاريخ إيقاف |
ما لم يتغير
الأسعار
يبقى سعر الرموز كما هو: 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و7.50 دولار من 1 يناير 2027.
كما لم تتغير:
- أسعار قراءة التخزين المؤقت.
- خصم الدفعات.
- 5000 طلب مجاني شهريًا لميزة تأسيس بحث جوجل، مشتركة بين نماذج Gemini 3.x.
السياق والأنماط
يقبل النموذجان 1,048,576 رمز إدخال و65,536 رمز إخراج. كما يدعمان النص والصورة والفيديو والصوت وPDF كإدخال، والنص كإخراج.
لا يدعم أي منهما:
- توليد الصوت.
- توليد الصور.
- واجهة Live API المباشرة.
السرعة
وصفت جوجل Gemini 3.8 Flash بأنه «بنفس سعر 3.7 وبنفس السرعة تقريبًا». قاست Artificial Analysis سرعة إخراج قدرها 302.1 رمزًا في الثانية عند مستوى التفكير high.
لكن سرعة الكتابة لا تساوي زمن إنجاز المهمة. بلغ وقت الوصول إلى أول رمز 13.30 ثانية في الاختبار نفسه، لأن النموذج يستدل أولًا قبل بدء الإخراج.
واجهة API
تُعد Interactions API المسار الأساسي لنماذج Gemini 3.x، بينما تظل نقطة النهاية القديمة generateContent مدعومة بالكامل دون تاريخ إيقاف.
في معظم الحالات، تعمل شيفرة 3.7 Flash على 3.8 بعد استبدال سلسلة النموذج فقط، باستثناء التغييرات الجذرية التالية.
ما الذي تحسن؟
صممت جوجل 3.8 Flash ليكون «نموذج Flash الأكثر ذكاءً» لمهام هندسة البرمجيات طويلة الأفق، والوكلاء المستقلين، وسير العمل المؤسسي المعقد.
في المهام الصعبة، ينفذ النموذج خطوات استدلال إضافية، ويستدعي الأدوات بشكل متكرر، ويتحقق من عمله أثناء التنفيذ.
نتائج جوجل
| المقياس المعياري | 3.8 Flash | 3.7 Flash | الفرق |
|---|---|---|---|
| وكيل Vals Finance v2 | 61.4% | 59.0% | +2.4 |
| HLE-Verified | 54.9% | 53.6% | +1.3 |
| مقياس Harvey Legal Agent | 10.0% | 8.8% | +1.2 |
المكاسب متواضعة لكنها متسقة. كما يتفوق 3.8 Flash في الصفوف الثلاثة على نماذج أكبر في جداول جوجل، مثل Claude Opus 5 الذي سجل 58.6% في Vals Finance و54.4% في HLE-Verified. وتتابع المقارنة الثلاثية مع Claude Fable 5.1 وGPT-5.6 Sol الاتجاه نفسه.
نتائج Artificial Analysis
رفعت Artificial Analysis مؤشر الذكاء الخاص بـ 3.8 Flash إلى 59 عند مستوى high، مقارنةً بـ56 لـ3.7 Flash و52 لـ3.6 Flash.
يربط ذلك النموذج بـ:
- GPT-5.6 Sol عند
xhigh. - Grok 4.6 عند
medium. - نقطة واحدة فوق Claude Fable 5.1 عند
medium.
وفي اختبار استخدام الأدوات τ³-Banking، سجل 3.8 Flash نسبة 45%، بزيادة 12 نقطة عن 3.7 Flash. هذه النتيجة أكثر أهمية من مؤشر الذكاء العام إذا كانت تطبيقاتك تستخدم وكلاء واستدعاءات أدوات فعلية.
سير العمل الطويلة وكثيفة المستندات
تقول جوجل إن 3.8 Flash يُكمل أكثر من ثلاثة أضعاف عدد المهام التي يُكملها 3.7 Flash في سير العمل الطويلة وكثيفة المستندات.
هذا تقييم داخلي ولا توجد منه بيئة اختبار عامة، لذلك ينبغي اعتباره مؤشرًا اتجاهيًا. لكنه يتوافق مع تصميم النموذج: التحقق المتكرر مفيد خصوصًا في مهمة من 40 خطوة قد يفشل فيها التنفيذ بالكامل بسبب خطأ واحد.
الترميز
سجل 3.7 Flash نسبة 65.3% في DeepSWE v1.1، مقارنةً بـ49.0% لـ3.6 Flash. وتقول جوجل إن 3.8 Flash يتفوق على معظم النماذج الحدودية الأكبر في هذا الاختبار بجزء بسيط من التكلفة.
لكن النسبة الدقيقة لـ3.8 Flash تظهر في جداول الصور داخل بطاقة النموذج فقط، وليس في النص المنشور، لذلك لا نطبع رقمًا غير موثق هنا. كما لم تُنشر في النص أرقام 3.8 Flash الخاصة بـSWE-Bench Pro أو Terminal-bench أو OSWorld. إذا كانت هذه المقاييس حاسمة لقرارك، فانتظر نتائج من طرف ثالث أو اختبر مستودعك مباشرة.
السلامة ومقاومة الحقن
تفيد جوجل بوجود «قفزة كبيرة» في اختبار حقن الأوامر Gray Swan، دون نشر رقم محدد.
أما الفروقات في بطاقة النموذج مقارنةً بـ3.7 Flash فهي:
- السلامة متعددة اللغات: +5.4 نقطة.
- سلامة النص إلى النص: -0.4 نقطة.
- الرفض غير المبرر: +1.1 نقطة.
تعني النتيجة الأخيرة زيادة طفيفة في الرفض المفرط.
ما الذي سيكلفك؟
لم تتغير أسعار الرموز، لكن تكلفة المهمة ارتفعت. توضح جوجل أن النموذج قد يستخدم رموزًا أكثر في المهام الأطول والأكثر تعقيدًا، خصوصًا عند مستويات التفكير الأعلى.
قاست Artificial Analysis متوسط 48,000 رمز إخراج لكل مهمة في 3.8 Flash، بزيادة 30% عن 3.7 Flash:
| التكوين | التكلفة لكل مهمة | الوقت لكل مهمة |
|---|---|---|
Gemini 3.7 Flash، high
|
0.40 دولار | 2.2 دقيقة |
Gemini 3.8 Flash، low
|
0.24 دولار | 0.8 دقيقة |
Gemini 3.8 Flash، medium
|
0.41 دولار | لم تُنشر |
Gemini 3.8 Flash، high
|
0.58 دولار | 2.5 دقيقة |
توضح النتائج ثلاث نقاط:
- يكلف 3.8 Flash عند
highنحو 45% أكثر لكل مهمة من 3.7 Flash عندhigh، ويستغرق وقتًا أطول بنحو 14%. - يكلف 3.8 Flash عند
mediumنحو 0.41 دولار، أي بفارق سنت واحد تقريبًا عن 3.7 Flash عندhigh. - يقدم 3.8 Flash عند
lowأقل تكلفة وأسرع زمن في الجدول، وهو مناسب للمسارات الحساسة للكمون التي تستخدمhighفي 3.7 Flash بدافع الإعدادات الافتراضية أو العادة.
الخلاصة: الترقية ليست مجانية عند القياس لكل مهمة، ومستوى التفكير هو الأداة الأساسية لتحديد مقدار التحسين الذي تشتريه.
التغييرات الجذرية
1. لم يعد minimal مقبولًا
يعيد الإعداد التالي خطأ تحقق في 3.8 Flash:
{
"thinking_level": "minimal"
}
يقبل 3.8 Flash المستويات low وmedium وhigh فقط. حوّل أي إعداد قديم يستخدم minimal إلى low.
2. يجب تضمين call_id وname
تحتاج كل استجابة function_result في Interactions API إلى الحقلين call_id وname.
وفي نقطة النهاية القديمة generateContent، يجب أن يتضمن كل functionResponse:
-
idالمطابق. -
name.
ستفشل الشيفرة التي تعيد بناء نتائج الوظائف بالاعتماد على الاسم فقط عند الدورة الثانية من حلقة الأدوات.
قواعد ترحيل إضافية
أعد التحقق من القواعد التالية أثناء الترحيل:
- أبقِ
temperatureعند القيمة الافتراضية1.0. تحذر جوجل من أن القيم الأقل قد تسبب حلقات أو أداءً متدهورًا. - استخدم
thinking_levelبدلًا منthinking_budgetكعدد صحيح. - أسقط
candidate_count. - مرر توقيعات التفكير مرة أخرى كما استلمتها بالضبط.
ليست هذه القواعد جديدة على 3.8، لكنها قد تكشف مشكلات في شيفرة 3.7 التي كانت تتجاهلها.
مصفوفة القرار حسب عبء العمل
| عبء العمل | التوصية | السبب |
|---|---|---|
| وكلاء متعددو الخطوات مع استدعاءات الأدوات | الترقية إلى medium أو high
|
+12 في τ³-Banking؛ حلقات الأدوات المتكررة هي جوهر 3.8 |
| استخراج ومراجعة المستندات الطويلة | الترقية | ادعاء إنجاز المهام بمعدل 3x يستهدف هذا السيناريو |
| الترميز الآلي في بيئة اختبار | الترقية ثم القياس | لم تُنشر النسبة النصية لـDeepSWE؛ اختبر مستودعك |
| وكلاء المالية والقانون والبحث | الترقية | جميع جداول جوجل المنشورة تميل إلى 3.8 |
| التصنيف والاستخراج والدردشة عالية الحجم | البقاء على 3.7 أو استخدام 3.8 عند low
|
تكلفة المهمة أهم؛ low أرخص من 3.7 عند high
|
| نقاط النهاية الحساسة للكمون | 3.8 عند low
|
0.8 دقيقة لكل مهمة مقابل 2.2 دقيقة لـ3.7 عند high
|
أي شيء يستخدم minimal
|
الترحيل أولًا | سيظهر خطأ تحقق حتى تحويله إلى low
|
| خطوط أنابيب الدفعة المسعّرة حسب الدقة | البقاء على 3.7 حتى إعادة القياس | السعر لكل رمز لم يتغير، لكن زيادة 30% في رموز الإخراج تغير الفاتورة |
القاعدة العملية: كلما كانت المهمة أصعب وأطول، استفاد عبء العمل أكثر من تصميم 3.8 Flash الذي «يعمل بجهد أكبر». وكلما كانت المهمة أقصر وأكثر تكرارًا، أصبح مستوى التفكير أو البقاء على 3.7 أهم.
اختبر النموذجين في Apidog
الأرقام السابقة مأخوذة من بيئة Artificial Analysis، وليست من بيئتك. قبل تغيير النموذج في الإنتاج، قارن النموذجين على طلباتك الفعلية.
الإعداد
- عيّن
GEMINI_API_KEYكمتغير بيئة في Apidog. - أضف طلب POST إلى:
https://generativelanguage.googleapis.com/v1beta/models/{{model}}:generateContent
- أرسل مفتاح API في الترويسة
x-goog-api-key، على أن تُقرأ قيمته من متغير البيئة. - اجعل
modelمتغيرًا في السيناريو. - استخدم الجسم نفسه في الاختبارين:
{
"contents": [
{
"parts": [
{
"text": "{{golden_prompt}}"
}
]
}
],
"generationConfig": {
"thinkingConfig": {
"thinkingLevel": "medium"
}
}
}
سيناريو المقارنة
أنشئ سيناريو من خطوتين:
- الطلب نفسه مع
modelيساويgemini-3.7-flash. - الطلب نفسه مع
modelيساويgemini-3.8-flash.
في كل خطوة، أضف تأكيدات على:
-
usageMetadata.candidatesTokenCount. -
usageMetadata.thoughtsTokenCount. - أي مسار JSON يقرأه تطبيقك.
ضع حدودًا قصوى للتوكنات بما يعكس ميزانيتك، وشغّل السيناريو على مجموعة من 10 أو 20 طلبًا ذهبيًا. يعرض تقرير Apidog الاستجابات ونتائج التأكيد معًا، لتصبح زيادة 30% رقمًا خاصًا بعبء عملك بدلًا من رقم معياري عام.
بعد التأكد من النتائج، قم بجدولة السيناريو بحيث يفشل الاختبار عند أي زيادة غير مقبولة في رموز التفكير بدلًا من اكتشافها في الفاتورة. تغطي الخطة المجانية هذا النوع من سير العمل.
الأسئلة الشائعة
هل Gemini 3.8 Flash أسرع من 3.7 Flash؟
ليس بالضرورة. تصف جوجل السرعة بأنها «مماثلة تقريبًا»، وقاست Artificial Analysis نحو 300 رمز إخراج في الثانية عند high. لكن خطوات الاستدلال الإضافية رفعت زمن المهمة في الاختبار إلى 2.5 دقيقة مقابل 2.2 دقيقة لـ3.7 Flash عند high. عند استخدام low، انخفض الزمن إلى 0.8 دقيقة.
هل يكلف Gemini 3.8 Flash أكثر من 3.7 Flash؟
ليس لكل رمز. السعر نفسه: 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و7.50 دولار.
أما لكل مهمة، فنعم. قدرت Artificial Analysis التكلفة بـ0.58 دولار لـ3.8 Flash عند high مقابل 0.40 دولار لـ3.7 Flash عند high، لأن 3.8 Flash يكتب نحو 30% من الرموز الإضافية.
هل ستوقف جوجل Gemini 3.7 Flash؟
تقول جوجل إن 3.7 Flash «لا يزال مدعومًا بالكامل»، ولم تنشر تاريخًا لإيقافه. يمكنك الاستمرار في استخدامه.
ما الذي سيتعطل عند التبديل إلى 3.8 Flash؟
تغييران أساسيان:
-
thinking_level: "minimal"يعيد خطأ400 INVALID_ARGUMENT. - يجب أن تتضمن استجابات الوظائف معرّف الاستدعاء واسم الوظيفة:
call_idفي Interactions API، وidفيgenerateContentالقديمة، إلى جانبname.
بقية Gemini 3 API لم تتغير وفق دليل الترحيل.
كيف تقارن هذه القفزة بالانتقال من 3.6 إلى 3.7؟
كانت قفزة 3.7 أكبر في بعض المقاييس: ارتفع DeepSWE من 49.0% إلى 65.3%، وارتفع مؤشر Artificial Analysis من 52 إلى 56.
أما 3.8 فقدم زيادة قدرها ثلاث نقاط في المؤشر، مع إعادة تصميم لطريقة استهلاك الرموز والتحقق من النتائج.
الخلاصة
قم بالترقية إذا كان عبء عملك قائمًا على الوكلاء، أو كثيف الأدوات، أو كثيف المستندات؛ فهنا تظهر مكاسب جوجل وArtificial Analysis، وهنا تشتري الرموز الإضافية مهامًا مكتملة.
ابقَ على 3.7 Flash، أو استخدم 3.8 عند مستوى low، إذا كانت تطبيقاتك تعتمد على استدعاءات قصيرة ومتكررة وتهمك تكلفة المهمة أو الكمون.
في كلتا الحالتين:
- حوّل
minimalإلىlow. - أصلح استجابات الوظائف لتتضمن المعرّفات والأسماء المطلوبة.
- قِس عدد الرموز على طلباتك الفعلية قبل اعتماد النموذج في الإنتاج.
الروابط والمصادر
- منشور إطلاق جوجل
- ما الجديد في Gemini 3.8 Flash
- ما هو Gemini 3.8 Flash
- صفحة تسعير جوجل
- مرجع مواصفات وأسعار Gemini 3.7 Flash
- صفحة DeepMind Flash
- Gemini 3.8 Flash مقابل Claude Fable 5.1 وGPT-5.6 Sol
- مقال Artificial Analysis
- بطاقة النموذج
- تفاصيل تسعير Gemini 3.8 Flash
- دليل مستويات التفكير
- دليل الترحيل من 3.7 إلى 3.8 Flash
- Apidog
- كيفية جدولة اختبارات API في Apidog
- تنزيل Apidog
- ما الجديد في Gemini 3.7 Flash
- Gemini 3.6 Flash مقابل Gemini 3.5 Flash
Top comments (0)