DEV Community

Cover image for كيفية استخدام Claude Haiku 5.5 API؟
Yusuf Khalidd
Yusuf Khalidd

Posted on Originally published at apidog.com

كيفية استخدام Claude Haiku 5.5 API؟

لاستخدام واجهة برمجة تطبيقات Claude Haiku 5.5، أرسل طلب POST إلى https://api.anthropic.com/v1/messages مع "model": "claude-haiku-5-5"، ومفتاحك في ترويسة x-api-key، وanthropic-version: 2023-06-01. تبلغ التكلفة 0.10 دولار / 0.50 دولار لكل مليون رمز إدخال/إخراج للمطالبات حتى 100 ألف رمز، و0.50 دولار / 2.50 دولار فوق ذلك. يدعم النموذج حتى مليون رمز سياقي و128 ألف رمز للإخراج، ويستخدم افتراضيًا مستوى جهد medium مع التفكير التكيفي.

جرّب Apidog اليوم

أطلقت Anthropic نموذج Haiku 5.5 في 7 أكتوبر 2026، وهو أول نموذج Haiku يدعم مستويات الجهد. يشرح دليل ما هو Claude Haiku 5.5 مواصفاته وموضعه ضمن النماذج الأخرى. في هذا الدليل ستنفذ أول استدعاء باستخدام curl وPython وTypeScript، ثم تضبط الجهد والتفكير والتخزين المؤقت والدفعات ومعالجة الرفض وأدوات الوكيل. يمكنك حفظ كل طلب واختباره في Apidog.

نظرة سريعة على واجهة برمجة تطبيقات Claude Haiku 5.5

المعلمة سلوك Haiku 5.5
معرف النموذج claude-haiku-5-5؛ وفي Bedrock: anthropic.claude-haiku-5-5
السعر لكل مليون رمز للمطالبات حتى 100 ألف رمز 0.10 دولار إدخال، 0.50 دولار إخراج، 0.01 دولار لقراءات التخزين المؤقت
السعر لكل مليون رمز للمطالبات فوق 100 ألف رمز 0.50 دولار إدخال، 2.50 دولار إخراج، 0.05 دولار لقراءات التخزين المؤقت
السياق / الحد الأقصى للإخراج 1 مليون / 128 ألف؛ و300 ألف في الدفعات باستخدام ترويسة output-300k-2026-03-24 التجريبية
output_config.effort low وmedium وhigh وxhigh وmax؛ الافتراضي هو medium
thinking adaptive افتراضيًا؛ ويمكن استخدام disabled عند high أو أقل فقط
thinking.display حقل thinking فارغ افتراضيًا؛ استخدم summarized للحصول على نص قابل للقراءة
temperature وtop_p وtop_k القيم غير الافتراضية تُرجع 400
ملء رد المساعد مسبقًا يُرجع 400، حتى عند تعطيل التفكير
الحد الأدنى للتخزين المؤقت 512 رمزًا، مقارنةً بـ4,096 في Haiku 4.5

المصادر: صفحة نموذج Haiku 5.5 ووثائق تسعير Claude API.

أول استدعاء لواجهة برمجة تطبيقات Claude Haiku 5.5

أنشئ مفتاح API من وحدة تحكم Claude، أو اتبع دليل مفتاح API الخاص بـ Anthropic، ثم خزّنه في متغير البيئة ANTHROPIC_API_KEY.

لا تضع المفتاح داخل المستودع أو ملفات المصدر. استخدم متغيرات البيئة أو مدير أسرار.

باستخدام curl

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "thinking": {"type": "adaptive", "display": "summarized"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

باستخدام Python

تلتقط حزمة Python SDK المتغير ANTHROPIC_API_KEY تلقائيًا من البيئة:

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    output_config={"effort": "medium"},
    thinking={"type": "adaptive", "display": "summarized"},
    messages=[
        {
            "role": "user",
            "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects.",
        }
    ],
)

for block in response.content:
    if block.type == "thinking":
        print("[thinking]", block.thinking)
    elif block.type == "text":
        print(block.text)

print(response.stop_reason, response.usage)
Enter fullscreen mode Exit fullscreen mode

باستخدام TypeScript

import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic();

const response = await client.messages.create({
  model: "claude-haiku-5-5",
  max_tokens: 4096,
  output_config: { effort: "medium" },
  thinking: { type: "adaptive", display: "summarized" },
  messages: [
    {
      role: "user",
      content:
        "Classify this ticket as billing, bug, or feature request: The export button times out on large projects.",
    },
  ],
});

for (const block of response.content) {
  if (block.type === "text") {
    console.log(block.text);
  }
}

console.log(response.stop_reason, response.usage);
Enter fullscreen mode Exit fullscreen mode

قواعد مهمة عند معالجة الاستجابة

  1. افحص نوع كل كتلة عبر block.type. قد تبدأ الاستجابة بكتلة thinking، لذلك الاعتماد على content[0].text قد يسبب خطأ.
  2. اترك هامشًا كافيًا في max_tokens، لأن رموز التفكير تدخل ضمن الحد.
  3. لا ترسل temperature أو top_p أو top_k أو budget_tokens.
  4. لا تستخدم ملء رد المساعد مسبقًا.
  5. أي من القيم السابقة قد يؤدي إلى استجابة 400.

إذا كنت تنقل تطبيقًا من إصدار أقدم، فراجع مقارنة Haiku 5.5 بـ Haiku 4.5 لمعرفة تغييرات JSON قبل وبعد الترحيل.

اختر مستوى الجهد

المعلمة output_config.effort هي الضبط الرئيسي للجودة والتأخير والتكلفة. تقترح وثائق المطالبات البدء بهذه المستويات:

  • low: أسرع وأقل تكلفة؛ مناسب للمحادثة، والمهام القصيرة، والطلبات البسيطة عالية الحجم.
  • medium: الافتراضي؛ مناسب لمعظم الاستخدامات والبرمجة الوسيطة.
  • high: لأعمال المعرفة، والوكلاء الأطول، واتباع التعليمات الصارم.
  • xhigh وmax: استخدمهما فقط عندما تثبت تقييماتك تحسنًا فعليًا.

في نتائج Anthropic الخاصة بـ OSWorld 2.1، يرتفع الأداء والتكلفة مع مستوى الجهد:

الجهد النتيجة التكلفة لكل محاولة
low 42.0% $0.0695
medium 53.3% $0.1257
high 61.3% $0.1827
xhigh 67.6% $0.2792
max 72.4% $0.6111

الانتقال من xhigh إلى max يضاعف التكلفة تقريبًا مقابل تحسن أقل من خمس نقاط. راجع تحليل معايير Haiku 5.5 قبل اعتماد مستوى جهد مرتفع في الإنتاج.

عند استخدام xhigh في محادثات متعددة الأدوار، قد تظهر الإجابة كاملة داخل كتلة التفكير ثم ينتهي الدور بلا كتلة نص مرئية. تحقق من وجود نص قابل للعرض قبل إرساله إلى المستخدم.

التحكم في التفكير

التفكير التكيفي مفعل افتراضيًا. عند عدم تحديد display، تحتوي كتلة thinking عادةً على توقيع signature فقط دون نص مقروء. لعرض ملخصات قابلة للقراءة في السجلات أو واجهة المستخدم، استخدم:

{
  "thinking": {
    "type": "adaptive",
    "display": "summarized"
  }
}
Enter fullscreen mode Exit fullscreen mode

لتقليل التفكير، خفّض مستوى effort. مجرد مطالبة النموذج بـ"الإجابة مباشرة" لا يعطل التفكير.

يمكنك تعطيل التفكير فقط عندما يكون مستوى الجهد high أو أقل:

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "thinking": {"type": "disabled"},
  "output_config": {"effort": "low"},
  "messages": [
    {
      "role": "user",
      "content": "Extract the invoice number from: INV-2291, due Nov 3."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

استخدام thinking: {"type": "disabled"} مع xhigh أو max يعيد 400.

في المحادثات متعددة الأدوار أو حلقات الوكيل:

  • أعد كتل التفكير كما استلمتها.
  • أضف الرسائل إلى السجل بدل إعادة كتابة السجل السابق.
  • لا تغيّر system أو tools أو الرسائل السابقة قبل كتلة التفكير المعادة.
  • كتل التفكير صالحة فقط للحساب الذي أنشأها، أو لحساب مرتبط به.

تخزين المطالبات والمهام الدفعية مؤقتًا

يقلل التخزين المؤقت تكلفة النصوص الثابتة المتكررة، مثل تعليمات النظام وسياسات الدعم وقوائم الأدوات.

للمطالبات حتى 100 ألف رمز:

  • قراءة ذاكرة التخزين المؤقت: 0.01 دولار لكل مليون رمز.
  • الإدخال الجديد: 0.10 دولار لكل مليون رمز.
  • كتابة ذاكرة تخزين مؤقت لمدة 5 دقائق: 0.125 دولار لكل مليون رمز.
  • كتابة لمدة ساعة: 0.20 دولار لكل مليون رمز.

الحد الأدنى للمحتوى القابل للتخزين المؤقت هو 512 رمزًا. ضع cache_control على البادئة الثابتة:

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "system": [
    {
      "type": "text",
      "text": "You are a support triage assistant. <long, stable policy text here>",
      "cache_control": {"type": "ephemeral"}
    }
  ],
  "messages": [
    {
      "role": "user",
      "content": "Ticket: refund not received after 10 days."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

تغيير effort على مستوى الطلب بين الاستدعاءات يبطل ذاكرة التخزين المؤقت. أما إعداد الجهد لكل رسالة باستخدام الترويسة التجريبية mid-conversation-output-config-2026-07-01، فيحافظ على التخزين المؤقت في Claude API وGoogle Cloud.

راجع وثائق التخزين المؤقت للمطالبات وشرح التخزين المؤقت للمطالبات.

استخدم الدفعات للمهام غير العاجلة

تخفض واجهة دفعات الرسائل الإدخال والإخراج بنسبة 50%:

  • حتى 100 ألف رمز: 0.05 دولار إدخال و0.25 دولار إخراج لكل مليون رمز.
  • فوق 100 ألف رمز: 0.25 دولار إدخال و1.25 دولار إخراج لكل مليون رمز.

الدفعات هي أيضًا الطريقة الوحيدة لطلب حتى 300 ألف رمز إخراج، باستخدام الترويسة التجريبية:

output-300k-2026-03-24
Enter fullscreen mode Exit fullscreen mode

راقب حد 100 ألف رمز؛ فالمطالبة التي تتجاوزه تنتقل إلى أسعار أعلى. راجع دليل تسعير Haiku 5.5 لأمثلة عملية.

التعامل مع stop_reason: "refusal"

يشغل Haiku 5.5 مصنفات أمان قد ترفض الطلب. عند الرفض، تكون قيمة stop_reason هي "refusal"، وقد تكون الفئة واحدة من:

  • cyber
  • frontier_llm
  • bio
  • general_harms

لا تعِد إرسال الطلب نفسه بشكل أعمى؛ غالبًا سيُرفض مرة أخرى. بدلاً من ذلك، افحص الاستجابة وسجل سبب الرفض:

def run(client, messages):
    response = client.messages.create(
        model="claude-haiku-5-5",
        max_tokens=4096,
        messages=messages,
    )

    if response.stop_reason == "refusal":
        details = getattr(response, "stop_details", None)
        category = getattr(details, "category", "unknown")

        log_refusal(category, messages)
        return {"status": "refused", "category": category}

    text = "".join(
        block.text
        for block in response.content
        if block.type == "text"
    )

    return {"status": "ok", "text": text}
Enter fullscreen mode Exit fullscreen mode

تحقق من stop_reason قبل قراءة content. في تطبيقك، وجّه الطلبات المرفوضة إلى مراجعة بشرية أو مسار بديل مناسب.

استخدام الكمبيوتر والمتصفح

على Claude API وGoogle Cloud، يدعم Haiku 5.5 استخدام الكمبيوتر عبر مجموعة الأدوات:

computer_toolset_20260801
Enter fullscreen mode Exit fullscreen mode

لا تحتاج هذه المجموعة إلى ترويسة تجريبية. أما إعلان الأداة القديمة computer_20250124 فيعيد 400.

يدعم النموذج أيضًا استخدام المتصفح عبر:

browser_toolset_20260801
Enter fullscreen mode Exit fullscreen mode

ولا يدعم Haiku 4.5 هذه المجموعة. راجع وثائق أداة استخدام الكمبيوتر لمعرفة الأدوات المتاحة.

حدود المعدل

يمتلك Haiku 5.5 نفس حدود المعدل الخاصة بـ Haiku 4.5:

المستوى الطلبات/الدقيقة رموز الإدخال/الدقيقة رموز الإخراج/الدقيقة
Start 1,000 2 مليون 400 ألف
Scale 10,000 10 مليون 2 مليون

لا يدعم النموذج مستوى الأولوية. لمعالجة أخطاء 429، راجع دليل تجاوز حد المعدل.

اختبر واجهة برمجة تطبيقات Claude Haiku 5.5 في Apidog

تجعل الطلبات المحفوظة مقارنة مستويات الجهد وتصحيح الرفض قابلة للتكرار. هذا إعداد عملي في Apidog:

إعداد طلب Claude Haiku 5.5 في Apidog

  1. أنشئ بيئة وأضف ANTHROPIC_API_KEY كمتغير سري.
  2. استخدم {{ANTHROPIC_API_KEY}} في ترويسة x-api-key.
  3. أضف الترويسات التالية:
   anthropic-version: 2023-06-01
   content-type: application/json
Enter fullscreen mode Exit fullscreen mode
  1. أنشئ طلب POST إلى:
   https://api.anthropic.com/v1/messages
Enter fullscreen mode Exit fullscreen mode
  1. الصق جسم أول استدعاء واحفظ الطلب.
  2. أضف تأكيدات للتحقق من:
    • الحالة 200.
    • أن $.stop_reason يساوي end_turn.
    • أن $.usage.output_tokens أكبر من 0.
    • أن $.content[*].type يحتوي على text.
  3. انسخ الطلب لمستويات low وhigh وxhigh وmax، ثم شغّل المجموعة وقارن usage والجودة.
  4. أضف مطالبة نظام مخزنة مؤقتًا وتحقق، في التشغيل الثاني، من أن:
   $.usage.cache_read_input_tokens > 0
Enter fullscreen mode Exit fullscreen mode

لأنماط اختبار أوسع، راجع اختبار تطبيقات LLM.

الأسئلة الشائعة

ما هو معرف نموذج Claude Haiku 5.5؟

استخدم claude-haiku-5-5 على Claude API وGoogle Cloud وMicrosoft Foundry وClaude Platform على AWS. على Amazon Bedrock، استخدم anthropic.claude-haiku-5-5.

هل توجد واجهة Claude Haiku 5.5 مجانية؟

لا توجد طبقة مجانية مستمرة. يحصل مستخدمو API الجدد على رصيد مجاني محدود للاختبار. يمكن لمستخدمي Claude.ai المجانيين تحديد Haiku 5.5 في الدردشة، لكن ذلك ليس مفتاح API. راجع دليل الوصول المجاني للتفاصيل.

لماذا يرجع طلب Haiku 4.5 السابق خطأ 400؟

تحقق من وجود أحد العناصر التالية:

  • budget_tokens
  • قيمة غير افتراضية لـ temperature
  • قيمة غير افتراضية لـ top_p
  • أي قيمة لـ top_k
  • ملء رد المساعد مسبقًا
  • الأداة القديمة computer_20250124

هل يمكن استخدام Haiku 5.5 في Claude Code؟

نعم، بدءًا من الإصدار 2.1.293. على Anthropic API، يشير الاسم المستعار haiku إلى Haiku 5.5. راجع Claude Haiku 5.5 في Claude Code.

هل أستخدم Haiku 5.5 أم Sonnet 5.5 للبرمجة الوسيطة؟

توصي Anthropic بـ Sonnet 5.5 وOpus 5.5 لمهام البرمجة الوسيطة المعقدة. استخدم Haiku 5.5 للمهام الضيقة، مثل التصنيف والتلخيص والضغط والوكلاء الفرعيين واستخدام المتصفح.

الخطوة التالية

ابدأ بطلب عند مستوى medium، ثم شغّله مجددًا عند low وhigh باستخدام مطالبة من عبء عملك الحقيقي. قارن بين usage.output_tokens وجودة الإجابة وزمن الاستجابة.

نزّل Apidog واحفظ التشغيلات الثلاثة مع التأكيدات، بحيث يصبح اختبار إصدار النموذج التالي تعديلًا في حقل واحد فقط.

Top comments (0)