Grok 4.6 هو نموذج اللغة الرائد من xAI، أُطلق في 12 أغسطس 2026. يبني على Grok 4.5 مع تركيز على الوكلاء طويلي الأمد، والترميز الوكيلي، والعمل التفاعلي والمرئي. يوفر نافذة سياق بحجم 500,000 رمز، بسعر 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. في مؤشر ذكاء Artificial Analysis، يسجل 61 نقطة، متعادلًا مع GPT-5.6 Sol ومتأخرًا بنقطة واحدة عن Claude Fable 5، ما يجعله خيارًا منخفض التكلفة ضمن نماذج الطليعة.
هذه هي الخلاصة. يشرح هذا الدليل ما تغيّر مقارنةً بـ Grok 4.5، وكيف تقرأ أرقام المعايير، وأين تستخدم النموذج، وكيف تختبره عمليًا قبل توجيه أي عبء إنتاجي إليه. إذا كنت تبني تطبيقات تعتمد على واجهات LLM API، فإن Apidog يوفّر مساحة عمل لتصميم طلبات API واختبارها ومحاكاتها، ما يساعدك على مقارنة Grok 4.6 مع مزودين آخرين دون كتابة عميل مخصص أولًا.
ملخص سريع
- تاريخ الإصدار: 12 أغسطس 2026، من xAI.
- التركيز: وكلاء ذوو أفق طويل، وترميز متعدد الخطوات، ومشاريع تفاعلية ومرئية. تقول xAI إن النموذج يختبر ويتحقق من عمله بشكل متكرر قبل المتابعة.
- المواصفات: نافذة سياق 500,000 رمز وتاريخ قطع معرفة في 1 فبراير 2026.
-
الأسعار: 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. تتوفر نسخة أسرع بسعر مضاعف
2x. - المعايير: مؤشر ذكاء 61، وقفزات من 54 إلى 65.9 في DeepSWE ومن 47.1 إلى 57.5 في APEX-Agents مقارنةً بـ Grok 4.5.
- التوفر: xAI API وGrok Build وCursor وOpenRouter وVercel وCloudflare.
Grok 4.6 في لمحة
| المواصفة | Grok 4.6 |
|---|---|
| المطور | xAI |
| تاريخ الإصدار | 12 أغسطس 2026 |
| نافذة السياق | 500,000 رمز |
| تاريخ قطع المعرفة | 1 فبراير 2026 |
| سعر الإدخال / الإخراج | 2 دولار / 6 دولارات لكل مليون رمز |
| النسخة السريعة | ضعف السعر 2x
|
| مؤشر الذكاء | 61 — GPT-5.6 Sol: 61، Claude Fable 5: 62 |
| التوفر | xAI API، Cursor، Grok Build، OpenRouter، Vercel، Cloudflare |
ما الجديد فعليًا مقارنةً بـ Grok 4.5؟
وفقًا لإعلان Grok 4.6، لا يتعلق الإصدار ببنية معمارية جديدة بقدر ما يتعلق بدورة تدريب تكميلية أطول من Grok 4.5.
تذكر xAI ثلاثة عناصر رئيسية في التدريب:
- بيانات منسقة أنشأها النموذج لاستهداف الاستدلال والمفاهيم التقنية المتقدمة.
- مجموعات بيانات هندسية عالية الجودة، امتدادًا للتدريب الغني بجلسات التطوير والترميز.
- مُحسِّن ووصفة تدريب محسّنان، مع إعادة إنشاء مسارات الضبط الدقيق الخاضعة للإشراف عبر مجالات الاستدلال والمجالات المتخصصة.
بالنسبة للمطورين، التغيير السلوكي الأهم هو التحقق الذاتي. في مهام الوكلاء الطويلة، يُفترض أن يتحقق Grok 4.6 من ناتج الخطوة السابقة قبل الانتقال إلى التالية: يشغّل الاختبار الذي أنشأه، ويعيد قراءة الملف الذي عدّله، ولا يواصل التنفيذ بناءً على افتراض غير متحقق منه.
هذا مهم خصوصًا عند استخدام النموذج في:
- تغييرات متعددة الملفات داخل مستودع قائم.
- وكلاء ينفذون سلسلة طويلة من استدعاءات الأدوات.
- إنشاء واجهات أو لوحات معلومات تحتاج مراجعة نتيجة التنفيذ، لا مجرد توليد كود.
- مهام تتطلب اختبارًا بعد كل تعديل.
لخلفية إضافية عن النهج التدريبي السابق، راجع تحليل ما يعنيه تدريب جلسات Cursor للمطورين.
المعايير: ما الذي تقوله الأرقام فعليًا؟
يجب التعامل مع نتائج الإطلاق بحذر، لكن الفروقات بين Grok 4.5 وGrok 4.6 تستحق الاختبار العملي.
ثلاث ملاحظات مهمة:
- تقلصت فجوة الوكلاء: ارتفع APEX-Agents بمقدار 10.4 نقاط، من 47.1 إلى 57.5. هذا يضع Grok 4.6 ضمن 1.7 نقطة من Fable 5 Max، وأعلى قليلًا من GPT-5.6 Sol Max عند 56.7%.
- تحسن الترميز على مستوى المستودعات: ارتفع DeepSWE من 54 إلى 65.9، أي ما يقارب 12 نقطة. ما زال Sol Max متقدمًا في هذا المعيار، لكن الفجوة أصبحت أقل.
- هناك مؤشرات مستقلة داعمة: قاست Artificial Analysis متوسط تكلفة قدره 0.84 دولار لكل مهمة في تقييماتها الوكيلة، وهو الأدنى بين النماذج الرائدة، مع تصنيف Elo يبلغ 1753 على GDPval-AA v2 لعمل المعرفة الاحترافي.
للحصول على سياق أعمق حول قراءة نتائج xAI ومحاذيرها، راجع تحليل معايير Grok 4.5.
الأسعار: كيف تحسب التكلفة الفعلية؟
حافظ Grok 4.6 على تسعيرة Grok 4.5:
| النموذج | سعر الإخراج لكل مليون رمز |
|---|---|
| Grok 4.6 | 6 دولارات |
| Claude Opus 4.8 | 25 دولارًا |
| GPT-5.6 Sol | 30 دولارًا |
مقابل GPT-5.6 Sol، يمثل هذا فرقًا يبلغ 5 أضعاف تقريبًا في تكلفة رموز الإخراج.
لكن لا تقارن تكلفة الرمز وحدها. استخدم هذه المعادلة عند تقييم مهمة وكيلة:
تكلفة المهمة = تكلفة الرموز + تكلفة الاستدعاءات الفاشلة + وقت المراجعة + وقت الإصلاح
قد يكون نموذج ما أرخص لكل رمز، لكنه يصبح أغلى إذا احتاج إلى إعادة تشغيل متكررة أو مراجعة بشرية مكثفة. لذلك اختبره على مهامك الحقيقية، مثل:
- إصلاح خطأ في مشروع قائم.
- تنفيذ ميزة صغيرة عبر عدة ملفات.
- إنشاء اختبارات وتشغيلها.
- استدعاء أدوات أو وظائف ذات مخططات JSON محددة.
- تلخيص أو تحليل مستندات كبيرة ضمن نافذة السياق.
النسخة الأسرع متاحة بسعر مضاعف: 4 دولارات لكل مليون رمز إدخال و12 دولارًا لكل مليون رمز إخراج. وهي موجهة للاستخدامات الحساسة للكمون. وحتى 19 أغسطس، يحصل مستخدمو Grok Build وCursor على ضعف الاستخدام المضمن خلال أسبوع الإطلاق.
أين تستخدم Grok 4.6 اليوم؟
يتوفر النموذج عبر الخيارات التالية:
- xAI API من خلال console.x.ai، مع توافق مع واجهة OpenAI API. يمكن تطبيق خطوات دليل Grok 4.5 API مباشرةً مع تغيير اسم النموذج.
- Cursor كخيار نموذج داخل بيئة التطوير.
- Grok Build، مساحة العمل الوكيلة من xAI.
- OpenRouter وVercel وCloudflare للفرق التي تمرر الطلبات عبر بوابة موحدة متعددة المزودين. يظهر على OpenRouter بالاسم:
x-ai/grok-4.6
لا يوجد هنا طرح مستقل موجه للمستهلكين. أسرع طريقة لتقييم Grok 4.6 هي عبر API أو IDE يدعمه بالفعل.
ابدأ اختبار API خلال دقائق
بما أن واجهة xAI متوافقة مع OpenAI، يمكنك البدء بتوجيه عميلك إلى:
https://api.x.ai/v1
استخدم متغيرات بيئة بدل تضمين المفاتيح أو أسماء النماذج داخل الكود:
export XAI_API_KEY="your_xai_api_key"
export XAI_BASE_URL="https://api.x.ai/v1"
export MODEL="your-grok-4-6-model-id"
ثم نفّذ طلب دردشة بسيطًا:
curl "$XAI_BASE_URL/chat/completions" \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d "{
\"model\": \"$MODEL\",
\"messages\": [
{
\"role\": \"system\",
\"content\": \"أنت مساعد برمجي. اشرح خطواتك باختصار واكتب اختبارات عند تعديل الكود.\"
},
{
\"role\": \"user\",
\"content\": \"اقترح خطة لإصلاح اختبار يفشل بعد تغيير واجهة دالة في عدة ملفات.\"
}
]
}"
لا تكتفِ بفحص النص الناتج. سجّل لكل تشغيل:
- زمن الاستجابة.
- رموز الإدخال والإخراج.
- عدد الاستدعاءات اللازمة لإكمال المهمة.
- نجاح الاختبارات.
- عدد التعديلات اليدوية المطلوبة بعد ناتج النموذج.
- صحة أي استدعاءات أدوات أو وظائف.
اختبار استدعاءات الأدوات
تركيز Grok 4.6 على الوكلاء يجعل التحقق من استدعاءات الأدوات ضروريًا. اختبر بنية الحمولة الناتجة، وليس النص فقط.
مثال لمخطط أداة بسيط:
{
"type": "function",
"function": {
"name": "run_tests",
"description": "تشغيل اختبارات المشروع وإرجاع الملخص",
"parameters": {
"type": "object",
"properties": {
"path": {
"type": "string",
"description": "مسار الاختبارات أو المجلد المطلوب تشغيله"
}
},
"required": ["path"]
}
}
}
عند التقييم، أضف تأكيدات للتحقق من أن النموذج:
- اختار اسم الأداة الصحيح.
- أرسل الحقول المطلوبة.
- استخدم أنواع البيانات الصحيحة.
- لم يخترع معاملات غير معرفة.
- تعامل مع أخطاء الأداة قبل متابعة الخطة.
يمكنك إعداد طلبات Grok وGPT وClaude في مشروع واحد داخل Apidog، ثم إنشاء بيئة مستقلة لكل مزود ومقارنة الجودة والكمون واستخدام الرموز.
القيود والأسئلة المفتوحة
التقييم العملي في أسبوع الإطلاق يجب أن يتضمن هذه المحاذير:
- معظم المعايير صادرة عن البائع. نشرت Artificial Analysis نتائج مستقلة متوافقة عمومًا مع القصة، لكن أرقام الترميز المحددة مثل DeepSWE وFrontierCode وCursorBench تأتي من جدول إطلاق xAI.
- نافذة السياق أصغر من بعض المنافسين. نافذة 500,000 رمز تغطي معظم أعباء العمل، لكن GPT-5.6 Sol يقدم 1.05 مليون رمز وClaude Fable 5 يقدم مليون رمز. قد يكون هذا فارقًا مهمًا إذا كنت تعالج مستودعات ضخمة أو مجموعات مستندات كبيرة في طلب واحد.
- GPT-5.6 Sol ما زال متقدمًا في أصعب مهام المستودعات. فجوة DeepSWE البالغة 7 نقاط تعني أن العمل المستقل بالكامل داخل قواعد كود كبيرة ما زال أقوى على GPT-5.6 Sol Max.
- نضج النظام البيئي متأخر نسبيًا. معالجة الدفعات وطبقات تخزين الأوامر المؤقتة وعناصر التحكم في الاستخدام لدى xAI أحدث من البدائل المقابلة في OpenAI وAnthropic.
هذه النقاط لا تلغي أهلية Grok 4.6، لكنها تحدد موقعه بوضوح: خيار قوي من ناحية السعر مقابل الأداء، ويستحق اختبارًا مباشرًا على عبء عملك قبل اعتماده.
خطة تقييم عملية قبل الإنتاج
استخدم خطة قصيرة بدل الاعتماد على معيار واحد:
- اختر 10 إلى 20 مهمة حقيقية من سجل تذاكر الفريق أو أخطاء تم حلها سابقًا.
- صنّف المهام إلى: توليد كود، إصلاح أخطاء، تغييرات متعددة الملفات، استدعاء أدوات، وتحليل مستندات.
- شغّل المهام نفسها على Grok 4.6 والنموذج الحالي لديك.
- ثبّت الإعدادات مثل prompt النظام، حد الرموز، وتعريفات الأدوات لضمان مقارنة عادلة.
- سجّل المقاييس: النجاح، الكمون، التكلفة، عدد مرات إعادة المحاولة، ومقدار التعديل البشري.
- اختبر الحالات الفاشلة عمدًا: أداة غير متاحة، اختبار فاشل، ملف مفقود، أو بيانات إدخال غير صالحة.
- اعتمد التوجيه التدريجي: ابدأ بحصة صغيرة من الطلبات بدل نقل عبء الإنتاج كاملًا دفعة واحدة.
ماذا يعني هذا لمطوري API؟
القراءة الاستراتيجية بسيطة: أصبح لدى نماذج الطليعة منافس حقيقي من حيث السعر. إذا كانت مخرجات بمستوى GPT-5.6 Sol تكلف سابقًا 25 إلى 30 دولارًا لكل مليون رمز إخراج، فإن Grok 4.6 يقدّم تسعيرة 6 دولارات.
يظهر الفرق بسرعة في الحلقات الوكيلة. إذا احتاج الوكيل إلى 40 استدعاء نموذج لإكمال مهمة، فإن فرق تكلفة الإخراج ليس هامشيًا.
ابدأ هكذا:
- وجّه عميل OpenAI المتوافق لديك إلى
https://api.x.ai/v1. - شغّل عبء عملك الحقيقي بدل prompts تجريبية قصيرة.
- قارن النجاح النهائي، لا البلاغة النصية فقط.
- اختبر استدعاءات الوظائف والأدوات بصرامة.
- راقب التكلفة لكل مهمة مكتملة، لا السعر لكل مليون رمز فقط.
الأسئلة الشائعة
ما هو Grok 4.6 في جملة واحدة؟
هو نموذج xAI الرائد لشهر أغسطس 2026، مهيأ للوكلاء طويلي الأمد والترميز، مع نافذة سياق 500,000 رمز ونتائج معيارية رائدة بتكلفة إخراج أقل بكثير من بعض المنافسين.
هل Grok 4.6 أفضل من GPT-5.6؟
يتعادلان عند 61 نقطة في مؤشر ذكاء Artificial Analysis. يتصدر GPT-5.6 Sol Max في الترميز على نطاق المستودعات وفق DeepSWE، بينما يتفوق Grok 4.6 قليلًا في APEX-Agents وتكلفة إخراجه أقل بنحو 5 أضعاف.
ما الفرق بين Grok 4.5 وGrok 4.6؟
السعر وواجهة API متشابهان، لكن Grok 4.6 حقق زيادة قدرها 11.9 نقطة على DeepSWE و10.4 نقاط على APEX-Agents، مع تركيز أكبر على التحقق الذاتي خلال المهام الطويلة.
هل يمكنني تجربة Grok 4.6 مجانًا؟
يتضمن Grok Build وCursor ضعف الاستخدام خلال أسبوع الإطلاق. كما أن الخطوات الواردة في دليل استخدام Grok 4.5 مجانًا تنطبق إلى حد كبير على Grok 4.6.

Top comments (0)