DEV Community

Cover image for مقارنة كلود هايكو 5.5 وجي بي تي-6 لونا
Yusuf Khalidd
Yusuf Khalidd

Posted on Originally published at apidog.com

مقارنة كلود هايكو 5.5 وجي بي تي-6 لونا

يتشارك Claude Haiku 5.5 وGPT-6 Luna سعرًا أساسيًا قدره 0.10 دولار / 0.50 دولار لكل مليون رمز إدخال/إخراج لمطالبات Haiku التي تصل إلى 100 ألف رمز، مع 0.01 دولار لقراءات التخزين المؤقت و0.125 دولار لكتاباته في كلا النموذجين. يظهر الفرق عند تجاوز العتبة: ينتقل Haiku 5.5 إلى 0.50 دولار / 2.50 دولار بعد 100 ألف رمز، بينما تحافظ Luna على سعرها الأساسي حتى 272 ألف رمز إدخال ثم تفرض ضعف سعر الإدخال و1.5 ضعف سعر الإخراج. في جدول إطلاق Anthropic، يسجل Haiku 5.5 نتائج أعلى في كل صف مشترك، لكن Luna أرخص لكل مهمة عند كل مستوى جهد في GDPval-AA وأربعة من خمسة مستويات في OSWorld.

جرّب Apidog اليوم

ستجد أدناه مقارنة عملية للسعر والمواصفات والمعايير والتكلفة حسب مستوى الجهد، ثم خطوات لاختبار النموذجين على مطالباتك. راجع أيضًا ما هو Claude Haiku 5.5 وما هو GPT-6 Luna. يوضح القسم العملي لاحقًا كيفية تشغيل Haiku 5.5 إلى جانب Luna في Apidog.

السعر جنبًا إلى جنب

لكل مليون رمز Claude Haiku 5.5 GPT-6 Luna
الإدخال، الطبقة الأساسية 0.10 دولار، لمطالبات تصل إلى 100 ألف رمز 0.10 دولار، حتى 272 ألف رمز إدخال
الإخراج، الطبقة الأساسية 0.50 دولار 0.50 دولار
قراءة التخزين المؤقت، الطبقة الأساسية 0.01 دولار 0.01 دولار
كتابة التخزين المؤقت، الطبقة الأساسية 0.125 دولار، لمدة 5 دقائق 0.125 دولار
الطبقة الأعلى، إدخال / إخراج 0.50 دولار / 2.50 دولار، بعد 100 ألف 0.20 دولار / 0.75 دولار، بعد 272 ألف
الطبقة الأعلى، قراءة / كتابة التخزين المؤقت 0.05 دولار / 0.625 دولار ضعف أسعار التخزين المؤقت
الدفعة 0.05 دولار / 0.25 دولار حتى 100 ألف؛ ثم 0.25 دولار / 1.25 دولار 50% من الأسعار القياسية في Batch وFlex

المصادر: وثائق تسعير Anthropic وصفحة نموذج GPT-6 Luna من OpenAI.

تعيد OpenAI تسعير «الطلب الكامل» فوق 272 ألف رمز. وتذكر Anthropic أن المطالبة التي تتجاوز 100 ألف رمز تُحاسب بالسعر الأعلى؛ أي إن طول الطلب كله يحدد الطبقة.

كيف تحسب تكلفة الطلب

استخدم هذه المعادلة:

تكلفة الإدخال = (رموز الإدخال / 1,000,000) × سعر الإدخال
تكلفة الإخراج = (رموز الإخراج / 1,000,000) × سعر الإخراج
إجمالي التكلفة = تكلفة الإدخال + تكلفة الإخراج
Enter fullscreen mode Exit fullscreen mode

مثالان محسوبان وفق أسعار كل مورد:

  • 150 ألف رمز إدخال و2 ألف رمز إخراج

    • Haiku 5.5: 0.15 × 0.50 + 0.002 × 2.50 = 0.080 دولار
    • Luna: 0.15 × 0.10 + 0.002 × 0.50 = 0.016 دولار
  • 300 ألف رمز إدخال و2 ألف رمز إخراج

    • Haiku 5.5: 0.30 × 0.50 + 0.002 × 2.50 = 0.155 دولار
    • Luna: 0.30 × 0.20 + 0.002 × 0.75 = 0.0615 دولار

قاعدة قرار سريعة:

  • أقل من 100 ألف رمز: السعر متطابق تقريبًا؛ اختبر الدقة وزمن الاستجابة.
  • بين 100 ألف و272 ألف رمز: Luna أقل تكلفة بوضوح.
  • فوق 272 ألف رمز: ينتقل النموذجان إلى الطبقة الأعلى، وتبقى Luna أقل تكلفة.

تقول Anthropic إن المطالبات التي تصل إلى 100 ألف رمز مثلت نحو 90% من طلبات Haiku 4.5. إذا كان توزيع طلباتك مشابهًا، فستكون معظم المكالمات بالسعر نفسه على النموذجين. راجع تسعير Claude Haiku 5.5 للحسابات التفصيلية.

مُحوّلات الرموز تحرك العتبة

الرمز في نموذج ليس بالضرورة رمزًا في النموذج الآخر. وفقًا لـ Anthropic، ينتج مُحوّل الرموز المحدّث في Haiku 5.5 رموزًا أكثر بنحو 30% من Haiku 4.5 للنص نفسه.

في موضوع إطلاق Hacker News، قدّر أحد المعلقين أن 100 ألف رمز في Claude الحديث قد تعادل نحو 60–65 ألف رمز في GPT الحديث. هذا تقدير مجتمعي وليس رقمًا رسميًا من المورد.

لذلك، لا تعتمد على عدد أحرف النص أو تقدير محلي فقط. نفّذ الآتي:

  1. أرسل عينات من مطالبات الإنتاج إلى كلا واجهتي API.
  2. احفظ كائن usage من كل استجابة.
  3. قارن input_tokens وoutput_tokens والتكلفة الفعلية.
  4. راقب الحالات التي تعبر عتبة 100 ألف أو 272 ألف رمز.

المواصفات

Claude Haiku 5.5 GPT-6 Luna
معرّف نموذج API claude-haiku-5-5 gpt-6-luna
نافذة السياق مليون رمز 1,050,000 رمز
الحد الأقصى للإخراج 128 ألف رمز، أو 300 ألف في الدفعات مع رأس تجريبي 128,000 رمز
تاريخ انتهاء المعرفة يونيو 2026 18 مايو 2026
مستويات الجهد منخفض، متوسط، مرتفع، مرتفع جدًا، أقصى بلا، منخفض، متوسط، مرتفع، مرتفع جدًا، أقصى
إيقاف التفكير thinking: {"type": "disabled"} عند جهد مرتفع أو أقل جهد استدلال none
وصول الدردشة المجاني يمكن لمستخدمي Claude.ai المجانيين اختياره المستخدمون المجانيون والمشتركون في تطبيق ChatGPT لسطح المكتب

يستخدم النموذجان medium افتراضيًا:

  • في Haiku 5.5: output_config.effort
  • في Luna: reasoning.effort

لا توفر طرق الدردشة المجانية مفتاح API، لذلك لا تصلح لتشغيل سكريبت أو مهمة CI أو وكيل. راجع Claude Haiku 5.5 مجانًا وGPT-6 Luna مجانًا.

ملاحظة مهمة عن التخزين المؤقت

في Haiku 5.5، يؤدي تغيير effort على المستوى الأعلى بين الطلبات إلى إبطال ذاكرة التخزين المؤقت للمطالبات. أما OpenAI فتقول إن تغيير جهد الاستدلال لم يعد يعطّل التخزين المؤقت في نماذج GPT-6.

إذا كنت تبني حلقة تكرارية تستخدم سياقًا ثابتًا، مثل وكيل يراجع ملفًا كبيرًا عدة مرات:

  • ثبّت مستوى الجهد في Haiku 5.5 عند الحاجة إلى الاستفادة من التخزين المؤقت.
  • راقب تكلفة القراءة والكتابة من التخزين المؤقت في بيانات الاستخدام.
  • راجع التخزين المؤقت لمطالبات GPT-6.

المعايير: جدول Anthropic، ومن شغّل خلية Luna

تأتي الأرقام التالية من منشور إطلاق Anthropic وبطاقة النظام الخاصة بها. جمعت Anthropic الجدول، لكن جهات مختلفة شغّلت صفوف Luna. نتائج Haiku 5.5 عند أقصى جهد، وغالبًا متوسط خمس تجارب.

المعيار Haiku 5.5 GPT-6 Luna مصدر بيانات Luna
GDPval-AA v2.1، Elo 1620 1437 تشغيل مستقل من Artificial Analysis
AA-Briefcase v1.1، Elo 1578 1336 تشغيل مستقل من Artificial Analysis
OSWorld 2.1، مجموعة فرعية غير متصلة بالإنترنت 72.4% 48.9% شغّلته Anthropic على 82 مهمة نفسها عبر OpenAI API
Terminal-Bench 4.0 39.2% 16.4% لوحة المتصدرين العامة، Codex CLI بأقصى جهد
FrontierCode 1.1، الرئيسي 46.4% 42.4% شغّلته Cognition: Claude في Claude Code وGPT في Codex
Chartography، بدون أدوات 46.4% 29.1% وفق تقرير Surge AI العام

لا يعني اشتراك الصفوف في اسم المعيار أنها نفذت في بيئة اختبار متطابقة. على سبيل المثال، يقارن Terminal-Bench أداء Haiku 5.5 في Claude Code بأداء Luna في Codex CLI.

يُعد OSWorld الأقرب إلى مقارنة مضبوطة لأن Anthropic شغّلت النموذجين على المهام نفسها، لكنه يظل اختبارًا نفذه مورد أحد النموذجين.

لا توجد مقارنة مستقلة مباشرة بعد. اعتبارًا من 8 أكتوبر 2026، لا توجد صفحة لـ Haiku 5.5 في Artificial Analysis، ولم تظهر نتائج له على Vals أو LMArena أو SWE-bench أو Aider. في ذلك اليوم، أدرجت لوحة AA نموذج GPT-6 Luna بأقصى جهد بمؤشر ذكاء 38 وسرعة 129 رمز إخراج في الثانية.

للتفاصيل، راجع معايير Claude Haiku 5.5.

التكلفة لكل محاولة عند كل مستوى جهد

يعرض جدول الإطلاق كل نموذج عند أقصى أداء. تعرض صفحة إطلاق Anthropic أيضًا الأداء والتكلفة عند مستويات الجهد المختلفة.

OSWorld 2.1

النتيجة هي درجة الائتمان الجزئي، ثم تكلفة المحاولة الواحدة:

الجهد Haiku 5.5 GPT-6 Luna
منخفض 42.0% / 0.0695 دولار 19.2% / 0.038 دولار
متوسط 53.3% / 0.1257 دولار 37.5% / 0.1261 دولار
مرتفع 61.3% / 0.1827 دولار 42.3% / 0.1435 دولار
مرتفع جدًا 67.6% / 0.2792 دولار 44.8% / 0.1672 دولار
أقصى 72.4% / 0.6111 دولار 48.9% / 0.205 دولار

GDPval-AA v2.1

النتيجة هي Elo، ثم تكلفة المهمة الواحدة:

الجهد Haiku 5.5 GPT-6 Luna
منخفض 1125 / 0.01167 دولار 1036 / 0.0038 دولار
متوسط 1277 / 0.03042 دولار 1262 / 0.02 دولار
مرتفع 1420 / 0.08938 دولار 1344 / 0.03 دولار
مرتفع جدًا 1513 / 0.26725 دولار 1364 / 0.05 دولار
أقصى 1620 / 0.86593 دولار 1437 / 0.09 دولار

ماذا تعني هذه الأرقام عمليًا؟

  • Luna أقل تكلفة عند كل مستوى جهد في GDPval-AA.
  • في OSWorld، Luna أقل تكلفة عند الجهد المنخفض والمرتفع والمرتفع جدًا والأقصى.
  • عند الجهد المتوسط في OSWorld، Haiku 5.5 أرخص بفارق طفيف جدًا: 0.1257 مقابل 0.1261 دولار.
  • يسجل Haiku 5.5 نقاطًا أعلى في كل مستوى جهد في هذه الجداول.

قارن النماذج عند إنفاق متقارب، وليس عند مستوى الجهد نفسه فقط:

  • OSWorld: عند المتوسط، يكلف Haiku 5.5 نحو 0.1257 دولار لكل محاولة ويحقق 53.3%، مقابل 0.1261 دولار و37.5% لـ Luna. كما أن Haiku عند المتوسط يتفوق على Luna عند أقصى جهد (48.9%) بتكلفة أقل.
  • GDPval-AA: Luna عند أقصى جهد (1437، 0.09 دولار) وHaiku 5.5 عند الجهد المرتفع (1420، 0.08938 دولار) متقاربان في التكلفة، مع فرق 17 نقطة Elo.

الاستنتاج العملي: في استخدام الكمبيوتر، يحقق Haiku 5.5 نتيجة أعلى مقابل الدولار وفق تشغيل Anthropic. في أعمال المعرفة، يكون النموذجان متقاربين عند ميزانية متساوية، وتكون Luna مناسبة عندما تكون الأولوية لأقل تكلفة مقبولة.

التوجيه: أي نموذج لأي عبء عمل؟

تضع Anthropic نموذج Haiku 5.5 للمهام «ذات النطاق الضيق»، وتقول إن Sonnet 5.5 وOpus 5.5 يظلان خيارين أفضل لمهام الترميز المعقدة التي تتطلب وكلاء. النموذجان هنا موجهان للاستخدام بكميات كبيرة.

عبء العمل ابدأ بـ السبب
التصنيف والتوجيه والاستخراج تحت 100 ألف رمز أي منهما؛ اختبر كليهما السعر متطابق، لذا اختر حسب دقة بياناتك
أسئلة وأجوبة المستندات الطويلة، من 100 ألف إلى 272 ألف رمز GPT-6 Luna تحتفظ بالسعر الأساسي، بينما يرتفع Haiku 5.5 خمسة أضعاف
أتمتة المتصفح وسطح المكتب Claude Haiku 5.5 نتيجة OSWorld أعلى عند تكلفة متقاربة
وكلاء فرعيون تحت Opus 5.5 أو Sonnet 5.5 Claude Haiku 5.5 إعداد Claude Code هو model: haiku، أي Haiku 5.5 على Anthropic API
أقل تكلفة لكل مكالمة GPT-6 Luna أقل حد معلن: 0.038 دولار في OSWorld و0.0038 دولار في GDPval-AA عند الجهد المنخفض
صياغة أعمال المعرفة بجهد عالٍ أي منهما؛ اختبر كليهما الفرق 17 Elo عند إنفاق متقارب في GDPval-AA

راجع Claude Haiku 5.5 في Claude Code للوكلاء الفرعيين، وGPT-6 Luna لأعباء عمل API عالية الحجم لخطوط الأنابيب عالية الاستعلام في الثانية.

إذا كنت تنتقل من Haiku 4.5، فراجع Haiku 5.5 مقابل Haiku 4.5 لمعرفة أخطاء 400 الخمسة الجديدة.

اختبر كلاهما جنبًا إلى جنب في Apidog

المقارنة التي تحسم القرار هي المقارنة على مطالباتك وبياناتك. في Apidog، أنشئ مشروعًا واحدًا يحتوي على طلبين متوازيين.

خطوات الاختبار

  1. خزّن ANTHROPIC_API_KEY ومفتاح OpenAI كمتغيرات بيئة.
  2. أنشئ طلبًا لـ Haiku 5.5 وطلبًا لـ Luna بالمطالبة نفسها.
  3. استخدم مستوى الجهد نفسه في الطلبين عند المقارنة.
  4. احفظ الاستجابة الكاملة، وخاصة usage وزمن الاستجابة.
  5. شغّل كل حالة عند الجهد المنخفض والمتوسط والمرتفع.
  6. قارن الدقة والتكلفة والرموز وزمن الوصول، لا النص الناتج فقط.
  7. تحقق من أن stop_reason في Haiku ليس "refusal"، إذ لا يوجد حل بديل من جانب الخادم لهذه الحالة.

مثال طلب Haiku 5.5:

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

لا تضف temperature أو top_p أو top_k بقيم غير افتراضية؛ إذ تعيد هذه القيم خطأ 400 على Haiku 5.5.

راجع كيفية استخدام Claude Haiku 5.5 API للتفاصيل، واختبار تطبيقات LLM لبناء مجموعات تقييم قابلة للتكرار.

الأسئلة الشائعة

هل Claude Haiku 5.5 وGPT-6 Luna بالسعر نفسه؟

نعم، لمطالبات Haiku حتى 100 ألف رمز: 0.10 دولار للإدخال و0.50 دولار للإخراج لكل مليون رمز، و0.01 دولار لقراءات التخزين المؤقت و0.125 دولار لكتاباته. بعد ذلك، ينتقل Haiku 5.5 إلى 0.50 دولار / 2.50 دولار، بينما تبقى Luna على السعر الأساسي حتى 272 ألف رمز.

أي نموذج يحقق نتائج أعلى؟

Haiku 5.5 في كل صف مشترك ضمن جدول إطلاق Anthropic. لكن Anthropic هي من جمعت الجدول، ولا توجد مقارنة مستقلة مباشرة بين النموذجين بعد.

أيهما أرخص لكل مهمة؟

Luna عادةً أرخص: في جميع مستويات جهد GDPval-AA وأربعة من خمسة مستويات في OSWorld. عند المستوى المتوسط من OSWorld فقط، يكون Haiku 5.5 أرخص بفارق 0.0004 دولار.

هل أي منهما مجاني؟

في الدردشة فقط: يمكن لمستخدمي Claude.ai المجانيين اختيار Haiku 5.5، ويحصل المستخدمون المجانيون وGo على Luna في تطبيق ChatGPT لسطح المكتب. لا يوفر أي من الخيارين مفتاح API. راجع Claude Haiku 5.5 مجانًا.

اختر حسب طول المطالبة، ثم اختبر

ابدأ بقياس أطوال مطالبات الإنتاج:

  • أقل من 100 ألف رمز: السعر متساوٍ؛ اجعل الدقة وزمن الاستجابة معيار الاختيار.
  • من 100 ألف إلى 272 ألف رمز: توفر Luna تكلفة كل مكالمة.
  • مهمات المتصفح وسطح المكتب: اختبر Haiku 5.5 أولًا وفق نتائج OSWorld المعروضة.
  • أي عبء عمل حرج: شغّل النموذجين على طلبات حقيقية بمستويين أو ثلاثة من الجهد.

نزّل Apidog، وضع الطلبين في مشروع واحد، ثم دع قيم usage ووقت الاستجابة ونتائج التقييم تحدد النموذج المناسب.

Top comments (0)