Gemini 3.8 Flash مقابل Claude Fable 5.1 وGPT-5.6 Sol: السعر والتكلفة لكل مهمة
خلال أسبوع واحد، أُطلقت أو أُعيد تسعير ثلاث واجهات برمجة تطبيقات رائدة ضمن ثلاث فئات سعرية. أطلقت جوجل Gemini 3.8 Flash في 2 سبتمبر 2026 بسعر 0.75 دولار لكل مليون توكن إدخال و3.75 دولار لكل مليون توكن إخراج، بينما أطلقت أنثروبيك Claude Fable 5.1 في اليوم السابق بسعر 10 دولارات و50 دولارًا. يقع GPT-5.6 Sol من OpenAI بينهما بسعر 5 دولارات و30 دولارًا. وعلى مؤشر الذكاء المستقل من Artificial Analysis، حصلت النماذج على 59 و57 و59 نقطة على التوالي؛ أي إن نموذجًا يكلف نحو جزء من 13 من الفئة الأغلى حقق الدرجة نفسها على المؤشر الذي يختبر النماذج الثلاثة بالطريقة نفسها.
لكن المؤشر يقيس الإجابة لكل مهمة، بينما تحسب الفاتورة عدد التوكنات المستخدمة في كل مهمة. وGemini 3.8 Flash مصمم، حسب جوجل، لاستخدام توكنات أكثر في المهام الطويلة والمعقدة. يقارن هذا الدليل النماذج من حيث المواصفات، والمعايير المنشورة، وأرقام Artificial Analysis، ثم يحولها إلى قاعدة عملية لاختيار واجهة برمجة التطبيقات المناسبة.
ملاحظة زمنية: قارنت المقارنة السابقة بين Gemini 3.7 Flash وClaude وGPT نموذج Claude Fable 5، وليس 5.1. استبدلت أنثروبيك النموذج في 1 سبتمبر، لذلك فهذه مقارنة جديدة وليست تحديثًا للمقال السابق.
المواصفات في لمحة
| المواصفة | Gemini 3.8 Flash | Claude Fable 5.1 | GPT-5.6 Sol |
|---|---|---|---|
| المورد | جوجل | أنثروبيك | OpenAI |
| نافذة السياق | 1,048,576 توكن | 1 مليون توكن | 1 مليون توكن |
| الحد الأقصى للإخراج | 65,536 توكن | 128 ألف توكن | 128 ألف توكن |
| سعر الإدخال لكل مليون توكن | 0.75 دولار تمهيديًا، ثم 1.50 دولار من 1 يناير 2027 | 10 دولارات | 5 دولارات |
| سعر الإخراج لكل مليون توكن | 3.75 دولار تمهيديًا، ثم 7.50 دولار من 1 يناير 2027 | 50 دولارًا | 30 دولارًا |
| قراءة الكاش لكل مليون توكن | 0.075 دولار تمهيديًا، ثم 0.15 دولار من 1 يناير 2027 | 0.25 دولار | 0.50 دولار |
| تاريخ قطع المعرفة | مارس 2026 | يونيو 2026 | غير مدرج هنا |
| التحكم في التفكير | منخفض/متوسط/مرتفع؛ المتوسط افتراضيًا | تفكير موسع ومفعل دائمًا | مستويات جهد تصل إلى xhigh |
| مؤشر Artificial Analysis | 59، مستوى مرتفع | 57، مستوى متوسط | 59، مستوى xhigh |
يمكنك مراجعة مقال Gemini 3.8 Flash الأساسي ودليل تسعير Gemini 3.8 Flash لتفاصيل الأسعار التمهيدية، والكاش، والدفعات، والتأسيس.
هناك نقطتان مهمتان:
- الحد الأقصى لإخراج Gemini يساوي نصف الحد الأقصى للنموذجين الآخرين: 65,536 مقابل 128 ألف توكن. يهم ذلك عند إنشاء مستندات طويلة في طلب واحد أكثر مما يهم في حلقات الوكلاء ذات الخطوات القصيرة.
- ينتهي السعر التمهيدي في 31 ديسمبر 2026. اعتبارًا من 1 يناير 2027، تتضاعف أسعار Gemini 3.8 Flash، فتتغير نسب المقارنة الواردة أدناه.
الرقم المستقل: 59، 57، 59
تجري Artificial Analysis التقييمات التسعة نفسها على كل نموذج وتنشر درجة واحدة لمؤشر الذكاء:
- Gemini 3.8 Flash بمستوى التفكير المرتفع: 59 نقطة، مقابل 56 لـGemini 3.7 Flash و52 لـGemini 3.6 Flash.
- GPT-5.6 Sol بمستوى جهد xhigh: 59 نقطة.
- Claude Fable 5.1 بمستوى جهد متوسط: 57 نقطة.
- حقق GPT-5.6 Terra بأقصى إعداد وMuse Spark 1.2 بمستوى xhigh أيضًا 57 نقطة.
- حقق Grok 4.6 بمستوى متوسط 59 نقطة.
لا تقرأ الرقم من دون قراءة مستوى التفكير. اختُبر Fable 5.1 بالمستوى المتوسط، بينما اختُبر Sol بالمستوى xhigh، وهو أعلى إعداداته. لذلك لا تمثل فجوة النقطتين ترتيبًا مباشرًا بين النموذجين.
الاستنتاج الأدق هو أن Gemini 3.8 Flash، في الإعدادات المختبرة، يطابق النموذجين المتميزين على هذا المؤشر، مع فارق سعري كبير لصالحه.
تكلفة الحصول على النتيجة
قاس التقرير أيضًا الموارد المطلوبة:
- استخدم Gemini 3.8 Flash في المستوى المرتفع 48,000 توكن إخراج لكل مهمة في المتوسط.
- يزيد ذلك بنسبة 30% عن Gemini 3.7 Flash.
- بلغت تكلفة المهمة 0.58 دولار.
- استغرقت المهمة 2.5 دقيقة، بسرعة إخراج تقارب 300 توكن في الثانية.
- بلغ الوقت حتى أول توكن 13.3 ثانية، لأن النموذج يفكر قبل الكتابة.
- في تقييم استخدام الأدوات τ³-Banking، سجل النموذج 45%، بزيادة 12 نقطة عن 3.7 Flash.
السعر لكل توكن لا يكفي وحده لتقدير التكلفة.
معايير جوجل: لماذا يغيب Fable 5.1؟
تنشر جوجل في صفحة Flash ثلاثة معايير عابرة للموردين. لا تتضمن هذه الجداول Claude Fable 5.1، لأن النموذج صدر قبل يوم واحد فقط من نشرها. وبدلًا منه، تعرض جوجل Claude Opus 5 وClaude Sonnet 5.
لذلك فإن عمود Anthropic أدناه لا يمثل Fable 5.1:
| المعيار | Gemini 3.8 Flash | Claude Opus 5 | Claude Sonnet 5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|---|---|
| HLE-Verified | 54.9% | 54.4% | 31.0% | 54.5% | 51.1% |
| Vals Finance Agent v2 | 61.4% | 58.6% | 53.9% | 53.8% | 54.4% |
| Harvey Legal Agent Benchmark | 10.0% | 6.7% | 5.0% | 2.5% | 0.8% |
في HLE-Verified يوجد تعادل عملي: 54.9% و54.4% و54.5% تقع جميعها ضمن نصف نقطة، بينما يتراجع Sonnet 5 بوضوح.
في Vals Finance Agent v2 يتقدم Gemini 3.8 Flash بفارق 2.8 نقطة عن Opus 5 و7.6 نقاط عن Sol، ضمن مهمة مالية وكيلة متعددة الخطوات.
أما Harvey Legal فهو حالة مختلفة؛ إذ سجلت جميع النماذج أقل من 11%، ولذلك يعبر الترتيب عن الفروق أكثر مما تعبر عنه الدرجات المطلقة.
للمقارنة التفصيلية، راجع معايير Claude Fable 5.1 ومعايير GPT-5.6 Sol.
ما الذي لا تعرضه جداول جوجل؟
لا توجد أرقام نصية لـGemini 3.8 Flash في:
- SWE-Bench Pro
- Terminal-bench
- OSWorld
أما DeepSWE v1.1، فتظهر نتيجته كادعاء بأن النموذج «يتفوق على معظم النماذج الحدودية الأكبر» بجزء صغير من التكلفة، بينما يوجد الرقم في جدول صورة لا في النص.
لمقارنات البرمجة واستخدام الكمبيوتر، يجب الرجوع إلى تشغيل كل مورد على معاييره الخاصة. تعرض أنثروبيك بياناتها في تفاصيل معايير Claude Fable 5.1، وتعرض OpenAI بياناتها في معايير GPT-5.6 Sol. لم يشغّل أي مورد نموذج المورد الآخر، لذلك تظل Artificial Analysis المصدر الوحيد للمقارنة المتكافئة.
فجوة الأسعار، سطرًا بسطر
بالأسعار التمهيدية:
- سعر إدخال Fable 5.1 البالغ 10 دولارات يساوي 13.3 ضعف سعر Gemini البالغ 0.75 دولار.
- سعر إخراج Fable 5.1 البالغ 50 دولارًا يساوي 13.3 ضعف سعر Gemini البالغ 3.75 دولار.
- سعر إدخال Sol البالغ 5 دولارات يساوي 6.7 أضعاف سعر Gemini.
- سعر إخراج Sol البالغ 30 دولارًا يساوي 8 أضعاف سعر Gemini.
- قراءة الكاش تكلف 0.075 دولار في Gemini، و0.25 دولار في Fable 5.1، و0.50 دولار في Sol.
- قراءة كاش Fable 5.1 تساوي نصف قراءة كاش Sol، وهو السطر الوحيد الذي لا يكون فيه النموذج الأغلى هو الأغلى تكلفة.
مثال حسابي
لنفترض عملية تستخدم مليون توكن إدخال و200,000 توكن إخراج، وكلها غير مخبأة:
- Gemini 3.8 Flash: 0.75 + 0.75 = 1.50 دولار
- GPT-5.6 Sol: 5.00 + 6.00 = 11.00 دولارًا
- Claude Fable 5.1: 10.00 + 10.00 = 20.00 دولارًا
من 1 يناير 2027، تصبح تكلفة العملية نفسها على Gemini:
- 1.50 دولار للإدخال
- 1.50 دولار للإخراج
- 3.00 دولارات إجمالًا
عندها تصبح العملية على Sol أغلى بنحو 3.7 أضعاف، وعلى Fable 5.1 بنحو 6.7 أضعاف. ينطبق التضاعف أيضًا على Gemini 3.6 Flash و3.7 Flash، لذلك لا يوجد إصدار Flash أرخص يمكن الرجوع إليه.
راجع أسعار Anthropic، ودليل تسعير Claude Fable 5.1، ودليل تسعير GPT-5.6 لمقارنة الدفعات والكاش.
احسب التكلفة لكل مهمة، لا لكل توكن
توضح جوجل أن Gemini 3.8 Flash «يمكنه استخدام المزيد من التوكنات في المهام الأطول والأكثر تعقيدًا، حسب التصميم». في المشكلات الصعبة، ينفذ خطوات تفكير أصغر، ويتحقق من عمله، ويستدعي الأدوات بشكل متكرر.
قاست Artificial Analysis هذا التأثير:
- 48,000 توكن إخراج لكل مهمة في المستوى المرتفع.
- تكلفة 0.58 دولار لكل مهمة.
- تكلفة 0.41 دولار في المستوى المتوسط.
- تكلفة 0.24 دولار في المستوى المنخفض.
- ارتفعت التكلفة من 0.40 دولار في Gemini 3.7 Flash إلى 0.58 دولار في 3.8 Flash، رغم ثبات أسعار التوكنات.
ينتج عن ذلك أمران:
- فارق 13.3 ضعفًا في سعر التوكن لا يعني بالضرورة فارقًا مماثلًا في الفاتورة. قد ينهي النموذج المتميز المهمة بعدد أقل من التوكنات أو استدعاءات الأدوات.
- في Gemini، يمثل مستوى التفكير محرك التكلفة الأساسي. أدى الانتقال من المستوى المرتفع إلى المنخفض إلى خفض تكلفة المهمة بأكثر من النصف في مجموعة Artificial Analysis.
استخدم دليل مستويات التفكير لضبط كل نقطة نهاية، وقارن أيضًا Gemini 3.8 Flash مع 3.7 Flash، فقد يكون النموذج الأقدم أفضل عندما تكون تكلفة المهمة أقل بنسبة 31%.
متى تختار كل نموذج؟
اختر Gemini 3.8 Flash للحجم الكبير والوكلاء منخفضي التكلفة
يصلح 3.8 Flash كنقطة بداية إذا كنت تشغل آلاف المهام الوكيلة يوميًا، لأنه:
- يطابق النماذج المتميزة على مؤشر Artificial Analysis في الإعداد المختبر.
- يتصدر جداول جوجل لوكلاء التمويل والقانون.
- يكلف جزءًا صغيرًا لكل توكن، حتى بعد زيادة يناير.
- يدعم الفيديو والصوت وPDF بصورة أصلية.
- يوفر دفعات بخصم 50%.
- يشمل 5,000 طلب مجاني شهريًا لتأسيس بحث جوجل.
- يقدم مستوى مجانيًا للنماذج الأولية.
المقايضات: إخراج نصي فقط، وعدم وجود Live API، وحد إخراج يبلغ 65,536 توكن، واحتمال ارتفاع استهلاك التوكنات في المستويين المتوسط والمرتفع.
اختر Claude Fable 5.1 لأصعب مهام الاستدلال الطويل
استخدم Fable 5.1 كطبقة تصعيد، لا كنقطة بداية. يناسب:
- وكلاء البحث الذين يعملون لساعات.
- جلسات الطرفية الطويلة.
- سلاسل الاستدلال التي تفشل فيها النماذج الأرخص.
- حلقات الوكلاء التي تعيد استخدام بادئة سياق كبيرة.
يساعد إخراجه البالغ 128 ألف توكن وقراءة الكاش البالغة 0.25 دولار في تقليل تكلفة السياقات المتكررة. راجع ما هو Claude Fable 5.1؟ للمواصفات.
اختر GPT-5.6 Sol لتشغيل وكلاء OpenAI
يسجل Sol 59 نقطة عند xhigh، ويتعادل مع Gemini 3.8 Flash في HLE-Verified، ويدعم إخراجًا يبلغ 128 ألف توكن بسعر 5 دولارات للإدخال و30 دولارًا للإخراج.
إذا كانت الوكلاء والتقييمات والأدوات لديك تعمل أصلًا ضمن حزمة OpenAI، يوفر Sol طبقة متميزة من دون إضافة مورد ثانٍ. لكن قراءة الكاش لديه الأغلى بين النماذج الثلاثة، لذا يناسب السياقات الجديدة أكثر من الجلسات الطويلة المخزنة مؤقتًا. راجع مقارنة Grok 4.6 وGPT-5.6 وClaude Fable 5.
اختبر النماذج الثلاثة في مساحة عمل واحدة باستخدام Apidog
لا تشغّل Apidog النماذج نفسها؛ فهو عميل ومنصة لاختبار واجهات برمجة التطبيقات. لكنه يتيح إرسال الطلب نفسه إلى الموردين الثلاثة ومقارنة النتائج.
الإعداد
أنشئ مشروعًا واحدًا بثلاث بيئات:
| البيئة | عنوان URL الأساسي | متغير المفتاح |
|---|---|---|
| Gemini | https://generativelanguage.googleapis.com |
GEMINI_API_KEY |
| Anthropic | قاعدة Anthropic الخاصة بك | مفتاح Claude |
| OpenAI | قاعدة OpenAI الخاصة بك | مفتاح OpenAI |
احفظ المفاتيح في متغيرات البيئة، ولا تضعها في نص الطلب أو المجموعة المشتركة.
بناء السيناريو
أنشئ سيناريو اختبار بثلاث خطوات طلب تستخدم الاستعلام نفسه. ترسل خطوة Gemini طلبًا إلى /v1beta/interactions:
{
"model": "gemini-3.8-flash",
"thinking_level": "medium"
}
أما الخطوتان الأخريان فترسلان إلى نقطتي الدردشة أو الرسائل الخاصتين بالموردين.
أضف إلى كل خطوة تأكيدات قابلة للمقارنة:
- استجابة HTTP برمز 200.
- مسار JSON يؤكد وجود الإجابة.
- حد أقصى لاستخدام التوكنات، حتى تفشل العملية صراحةً إذا تضاعف استهلاك توكنات التفكير.
- في Gemini، افحص
usageMetadata.thoughtsTokenCountفي نقطة النهاية القديمة، أو كتلة الاستخدام المكافئة في النموذجين الآخرين.
شغّل السيناريو على مجموعة من الاستعلامات الذهبية ثم جدول تشغيله يوميًا. ستكشف التأكيدات الفاشلة تغييرات الإعدادات الافتراضية أو زيادة استهلاك التوكنات قبل وصول الفاتورة. يمكنك الرجوع إلى دليل اختبار واجهة برمجة تطبيقات وكيل الذكاء الاصطناعي ودليل جدولة اختبارات واجهة برمجة التطبيقات في Apidog، أو تنزيل Apidog.
الأسئلة الشائعة
هل Gemini 3.8 Flash أفضل من Claude Fable 5.1؟
على مؤشر Artificial Analysis، سجل Gemini 3.8 Flash في المستوى المرتفع 59 نقطة، بينما سجل Fable 5.1 في المستوى المتوسط 57 نقطة. لا تتضمن جداول جوجل Fable 5.1، ولا تتضمن معايير Anthropic Gemini 3.8 Flash، لذلك لا توجد مقارنة أوسع مباشرة. لكل توكن، Flash أرخص 13.3 مرة بالأسعار التمهيدية.
أي النماذج الثلاثة هو الأرخص لأعباء العمل الوكيلة؟
Gemini 3.8 Flash هو الأرخص لكل توكن، بسعر 0.75 دولار للإدخال و3.75 دولار للإخراج حتى 31 ديسمبر 2026. وقدرت Artificial Analysis تكلفة المهمة بنحو 0.58 دولار في المستوى المرتفع، و0.41 دولار في المتوسط، و0.24 دولار في المنخفض. قِس تكلفة المهمة المكتملة على بياناتك قبل اتخاذ القرار.
هل تملك النماذج الثلاثة نافذة سياق بحجم مليون توكن؟
نعم. يقبل Gemini 3.8 Flash ما يصل إلى 1,048,576 توكن إدخال، بينما يُدرج كل من Fable 5.1 وGPT-5.6 Sol نافذة سياق بحجم مليون توكن. يختلف حد الإخراج: 65,536 توكن في Gemini مقابل 128 ألفًا في النموذجين الآخرين.
لماذا لا يظهر Claude Fable 5.1 في جداول جوجل؟
تعرض جوجل Claude Opus 5 وClaude Sonnet 5 كمدخلات Anthropic. صدر Fable 5.1 في 1 سبتمبر، قبل يوم واحد من Gemini 3.8 Flash، لذلك لم يكن متاحًا عند إعداد الجداول. للحصول على مقارنة خاصة تديرها أنثروبيك، راجع Claude Fable 5.1 مقابل Opus 5.
هل تستمر أفضلية سعر Gemini بعد 2027؟
جزئيًا. من 1 يناير 2027، يصبح السعر 1.50 دولار للإدخال و7.50 دولار للإخراج. عندها يكون Fable 5.1 أغلى بنحو 6.7 أضعاف في الخطين، بينما يكون Sol أغلى 3.3 أضعاف في الإدخال و4 أضعاف في الإخراج. يظل Gemini أرخص، لكن الفارق ينخفض.
الخلاصة
ابدأ بـGemini 3.8 Flash للأحجام الكبيرة، واضبط thinking_level لكل مسار، وراقب التوكنات لكل مهمة بدلًا من السعر المعلن فقط.
صعّد إلى Claude Fable 5.1 عندما تفشل تقييماتك على النماذج الأرخص، خصوصًا إذا كنت تعيد استخدام سياق كبير عبر أدوار متعددة.
استخدم GPT-5.6 Sol عندما تعمل بقية مجموعتك ضمن OpenAI وتريد طبقة متميزة من دون إضافة مورد ثانٍ.
وقبل الالتزام بأي نموذج، شغّل الاستعلام نفسه على النماذج الثلاثة في سيناريو اختبار واحد. نسبة السعر عامة، أما نسبة التكلفة لكل مهمة على بياناتك فلا يحددها إلا القياس.
Top comments (0)