Grok 4.6 من SpaceXAI: الدليل الكامل بعد أسبوع من الإطلاق — الأداء والسعر وطريقة الاستخدام

Grok 4.6 يصل لمستوى الصف الأول: 61 في مؤشر الذكاء و69.9% في CursorBench وبسعر 2$ و6$ للمليون رمز. دليلك الكامل للأداء والتوفر والمقارنة مع GPT-5.6 وFable 5.

Grok 4.6 من SpaceXAI: الدليل الكامل بعد أسبوع من الإطلاق — الأداء والسعر وطريقة الاستخدام
Table of contents

أطلقت SpaceXAI نموذجها الجديد Grok 4.6 يوم 12 أغسطس 2026، وبعد أسبوع كامل من الإطلاق أصبحت الصورة واضحة بما يكفي لنجيب على الأسئلة التي يطرحها الباحثون العرب فعلاً: ما الجديد مقارنة بـGrok 4.5؟ هل ينافس GPT-5.6 وClaude؟ كم تكلفة استخدامه عبر الـAPI؟ وكيف تستفيد منه من الخليج اليوم؟ — آخر تحديث 19 أغسطس 2026.

الإعلان الرسمي عن إطلاق Grok 4.6 من xAI

المصدر: x.ai — Introducing Grok 4.6 (12 أغسطس 2026)

هذه ليست تغطية «لحظة إطلاق» — الحدث عمره سبعة أيام — بل دليل شامل يجمع كل ما هو موثق رسمياً عن النموذج مع قراءة عملية لقيمته الحقيقية لمن يفكر في استخدامه الآن: الطالب الذي يبني مشروعه التخرج، المطور العربي الذي يريد نموذج برمجة بأسعار معقولة، أو صاحب العمل الصغير الذي يجرّب الوكلاء الأذكياء لأول مرة.

ما هو Grok 4.6 في جملة واحدة؟

Grok 4.6 هو الإصدار الذي يبني على Grok 4.5 بتركيز خاص — بحسب صفحة الإعلان الرسمية حرفياً — على «الوكلاء طويلي التشغيل والأعمال التفاعلية والبصرية الأكثر طموحاً». بمعنى عملي: نموذج مصمم ليبقى مع مهمة واحدة عبر عشرات الخطوات — يبحث عن موضوع، يحلل معلومات، يعمل عبر قاعدة كود كاملة، أو يحوّل فكرة إلى تطبيق مكتمل — دون أن «ينسى» ما كان يفعله أو يفقد الخيط في المنتصف.

هوية SpaceXAI الرسمية — الشركة المطورة لنماذج Grok

المصدر: x.ai — الصورة الرسمية للهوية

الأرقام الرسمية: أين يقف Grok 4.6 فعلاً؟

البيانات التالية منقولة كما هي من جدول التقييمات الرسمي في صفحة الإعلان، وهي تقارن Grok 4.6 High مع Grok 4.5 High ومع GPT-5.6 Sol Max من OpenAI وFable 5 Max من Anthropic:

التقييم Grok 4.6 Grok 4.5 GPT-5.6 Sol Max Fable 5 Max
AA Intelligence Index 61 56 61 62
GDPVal-AA v2 1753 1526 1728 1741
CursorBench v3.2 69.9% 66.7% 67.2% 70.5%
DeepSWE v1.1 65.9% 54% 73% 70%
FrontierCode v1.1 61.3% 56.6% 60.6% 63.6%
APEX-Agents 57.5% 47.1% 56.7% 59.2%
Terminal-Bench v3.0 26% 15.7% 34.6% 34.1%
AA-Briefcase 1577 1313 1502 1574

قراءة صادقة في هذه الأرقام قبل أن نبني عليها:

  • القفزة عن Grok 4.5 حقيقية ومتسقة: تحسن بـ5 نقاط في مؤشر الذكاء العام (56 إلى 61)، و227 نقطة في GDPVal-AA، ومضاعفة تقريبية في Terminal-Bench (15.7% إلى 26%). من يستخدم Grok 4.5 اليوم سيلاحظ الفرق.
  • مبارزة القمة شديدة القرب: في CursorBench — وهو اختبار مباشر لأدوات البرمجة التحريرية — يتقدم Grok 4.6 (69.9%) على GPT-5.6 Sol Max (67.2%) ويقترب من Fable 5 Max (70.5%). في مؤشر الذكاء العام يتعادل مع GPT-5.6 Sol عند 61 خلف Fable 5 Max عند 62. هذه ليست هيمنة، لكنها مقعد حقيقي على طاولة الصف الأول.
  • نقطة الضعف الصريحة: DeepSWE — هندسة البرمجيات الطويلة والعميقة — يتقدم فيه GPT-5.6 Sol Max بفارق واضح (73% مقابل 65.9%)، ومثله Terminal-Bench (34.6% مقابل 26%). إن كان عملك اليومي إصلاح مشكلات معقدة في قواعد كود ضخمة عبر الطرفية، فالمتصدر الحالي ليس Grok.
  • الاختبارات جهة واحدة: الأرقام منشورة من xAI نفسها (مع الإشارة إلى أن أرقام الطرف الثالث هي الأفضل من المعلن ذاتياً أو المتاح علناً)، والعادة الحكيمة هي انتظار تقييمات مستقلة قبل تعميم الحكم النهائي.

كيف درّبت SpaceXAI النموذج؟

صفحة الإعلان تفصّل منهجاً تدريبياً من ثلاث مراحل تستحق الفهم لأنها تفسّر الأرقام أعلاه:

  1. جولة تدريب تكميلية أطول من التي خضع لها Grok 4.5، اعتمدت على بيانات مولّدة بالنماذج منسّقة بعناية لمهارات الاستدلال والمفاهيم التقنية المتقدمة، مع بيانات هندسية عالية الجودة وواقع تحسين (optimizer) محسّن.
  2. إعادة توليد مسارات SFT باستخدام Grok 4.5 نفسه: أي أن النموذج الأقدم استُخدم لتوليد أمثلة التدريب الإشرافي للنموذج الأحدث عبر مستويات استدلال مختلفة وبيئات وكلاء متنوعة ومجالات مثل العلوم والهندسة البرمجية، مع ترشيح المسارات الإشكالية بفحوص قائمة على النماذج.
  3. تعلم معزز وكيلي واسع النطاق: مهام معرفية وبرمجة عامة وبيئات متخصصة تشمل تحسين أنوية النظم (kernel optimization) وتطوير الويب والتصميم بمساعدة الحاسوب (CAD).

النتيجة المعلنة: جيل أول أقوى للمسارات الطويلة، وسلوك محسّن، وقدرة أوضح على «الاختبار الذاتي والتحقق» — النموذج يراجع عمله قبل الانتقال للخطوة التالية.

السعر: نقطة Grok الأقوى أمام الجمهور

التسعير الرسمي المعلن لتطبيقات الـAPI:

  • 2 دولار لكل مليون رمز إدخال (input)
  • 6 دولارات لكل مليون رمز إخراج (output)
  • نسخة سريعة (fast variant) بضعف السعر — أي 4 دولارات إدخال و12 دولاراً إخراجاً لكل مليون رمز

هذا التسعير يضع Grok 4.6 في الشريحة الاقتصادية من نماذج الصف الأول — وهو استمرار لاستراتيجية واضحة من SpaceXAI سبق أن رصدناها عند إطلاق Grok 4.5 بأداء بمستوى Opus وتكلفة أقل بـ60%. للمطور العربي الذي يبني منتجاً يستهلك ملايين الرموز يومياً، فارق التسعير هذا يتضاعف على مستوى الشهر والسنة.

ويجدر بالأمانة التاريخية ذكر عرض الإطلاق: ضِعف الحصة المضمّنة داخل Grok Build وCursor طوال الأسبوع الأول من الإطلاق — وهو عرض انتهى الآن (نكتب بعد أسبوع من الإطلاق)، فلا تبنِ حساباتك عليه.

أين تستخدمه اليوم؟ قنوات الوصول الرسمية

وفق صفحة الإعلان، Grok 4.6 متاح منذ يوم الإطلاق في:

  • Cursor — محرر البرمجة بالذكاء الاصطناعي، ويُباع اشتراكه عالمياً بالبطاقة الدولية
  • Grok Build — بيئة البناء الخاصة بـSpaceXAI
  • الـAPI مباشرة عبر إنشاء مفتاح من منصة المطورين
  • الشركاء: OpenRouter وVercel وCloudflare

من الخليج، لا توجد أي عقبة معلنة أمام أي من هذه القنوات: اشتراك Cursor يُدفع بالبطاقة الدولية، وOpenRouter يبيع بالدفع المسبق بالدولار، وAPI الفواتير تتم بالبطاقة — القيود، إن وجدت لاحقاً، ستكون قيود عقوبات أو امتثال مصرفي لا قيود إعلانية. وإذا كنت جديداً على نموذج واحد بعينه، فمنصة LM Arena لمقارنة نماذج الذكاء الاصطناعي تمنحك مقارنة عمياء قبل أن تدفع دولاراً — وهي طريقتنا المفضلة لاختبار أي نموذج جديد.

وللسياق: هذا الإطلاق يأتي بعد أيام من إغلاق SpaceXAI صفقة استحواذها على Cursor بقيمة 60 مليار دولار، ثم إطلاق Cursor لمنصة Origin لاستضافة الكود — أي أن توفر Grok 4.6 داخل Cursor يوم واحد ليس صدفة تحديث، بل ثمرة اندماج فعلي بين الشركة المطورة للنموذج والشركة المطورة للأداة.

مقارنة سريعة: Grok 4.6 أمام البدائل التي يستخدمها العرب اليوم

المعيار Grok 4.6 GPT-5.6 Sol (OpenAI) Fable 5 Max (Anthropic) Gemini 3.7 Flash (Google)
سعر الـAPI لكل مليون رمز 2$/6$ الأعلى في فئته مرتفع الأرخص للإخراج السريع
مؤشر الذكاء العام (AA) 61 61 62 غير مدرج في الجدول
البرمجة التحريرية (CursorBench) 69.9% 67.2% 70.5%
هندسة البرمجيات العميقة (DeepSWE) 65.9% 73% 70%
أبرز نقطة قوة سعر/أداء + الوكلاء الطويلين أعمق أداء هندسي أعلى مؤشر ذكاء سرعة وتكلفة منخفضة
الوصول من الخليج API + Cursor + OpenRouter API + ChatGPT API + Claude API + Gemini

الخلاصة العملية من الجدول: إن كان معيارك «أفضل أداء هندسي عميق بأي سعر» فـGPT-5.6 Sol Max لا يزال الأميز في هذه الدفعة. وإن كان معيارك «أداء صف أول بأقل فاتورة» — وهو معيار أغلب المشاريع العربية الناشئة — فـGrok 4.6 يقدم اليوم أقوى معادلة موثقة. ولمن يريد مقارنة أوسع بمنظور الطالب، يبقى دليلنا كلود أوبوس 5 وتغطيتنا لإعادة إطلاق Claude Fable 5 مرجعين مكملين.

الأمان: أوسع حزمة اختبار قبل النشر في تاريخ الشركة

تقول الصفحة الرسمية إن حزمة ضمانات Grok 4.6 «حسّنت ومعايرت بما يناسب قدرات النموذج»، وإن الشركة نفذت «أوسع حزمة اختبارات قبل النشر على الإطلاق» لقدرات النموذج ومعايرة ضماناته، مع اختبارات ما بعد النشر واختبارات طرف ثالث. وتشير إلى أن مكدس الأمان مصمم لتحقيق أقصى فائدة وأمان في الاستخدامات المشروعة، مثل ترقيع الثغرات الأمنية وتسريع دورة التصميم الهندسي ودعم أبحاث الذكاء الاصطناعي.

في أسبوعٍ شهد أيضاً إبطاء OpenAI تدريب نماذجها الحدودية لأسباب أمنية، يصبح هذا المستوى من التفصيل حول اختبارات ما قبل النشر معلومة جوهرية لا دعاية هامشية: سباق النماذج دخل مرحلة يُقاس فيها النضج الأمني بجدية القدرات نفسها.

خطة اختبار عملية في 30 دقيقة قبل أن تلتزم

أفضل طريقة لحسم «هل هذا النموذج لي؟» ليست قراءة الجداول بل اختبار مصغّر على مهامك الفعلية، وهذه خطة مجرّبة تستهلك أقل من دولار عبر OpenRouter:

  1. جهّز ثلاث مهام تمثل عملك الحقيقي: واحدة برمجية متعددة الملفات (مثلاً: أضف شاشة إحصائيات لتطبيقك القائم)، واحدة معرفية تتطلب بحثاً وتجميعاً (مثلاً: لخّص متطلبات توثيق منتج في سوقين مختلفين)، وواحدة «فكرة إلى منتج» (مثلاً: صفحة هبوط تفاعلية لفكرة خدمة صغيرة).
  2. شغّل المهمة الواحدة مرتين: مرة بـGrok 4.6 ومرة بالنموذج الذي تستخدمه اليوم، بنفس البرومبت بالضبط، دون قراءة اسم النموذج قبل تقييم النتيجة — المقارنة العمياء تلغي الانحياز.
  3. قيّم بثلاثة معايير فقط: هل أكمل المهمة حتى النهاية دون أن يفقد الخيط؟ كم جولة تصحيح احتجت؟ وكم كلفك الأمر فعلياً بالدولار؟
  4. راجع الفاتورة قبل الحكم النهائي: ميزة OpenRouter أنك ترى تكلفة كل طلب على حدة، فإذا أخرج Grok 4.6 نتيجة قريبة من المنافس بثلث الفاتورة، فالقرار يكون حسابياً بسيطاً.

هذا الأسلوب تحديداً هو ما نوصي به في كل استعراضاتنا للنماذج، لأن فروق الاختبارات المعيارية بنقطة أو نقطتين أقل أهمية عملياً من «أيهم يكمل مهمتك أنت بأقل تدخل».

قصة استخدام: من فكرة إلى نسخة أولى تعمل

السيناريو الذي تبرزه SpaceXAI بنفسها — وتتطابق معه تجارب المستخدمين المنشورة خلال الأسبوع الأول — هو تحويل «فكرة منتج واسعة» إلى «نسخة أولى عاملة»: النموذج يبحث في مجال غير مألوف له، يبني هيكل التطبيق، ينفذ التفاعلات الجوهرية، ثم يواصل تنقيح النتيجة عبر عدة جولات تغذية راجعة، مع قدرة أوضح على تأسيس «اللغة البصرية» للتطبيق في جولة واحدة — وهو ما تصفه الشركة بكونه أنتج «مرات أولى أقوى» في المشاريع البصرية والتفاعلية مقارنة بما اعتادوه مع Grok 4.5.

ترجمة ذلك لطالب يبني مشروع تخرج: اطلب تطبيق لوحة تحكم لمتابعة ميزانية أسرة صغيرة، فيبني Grok 4.6 الهيكل والشاشات والتفاعلات، ثم تنقّح معه تفاصيل كل شاشة — بدل البدء من صفحة بيضاء. وترجمته لمطور: كلّفه بمهمة متعددة الملفات عبر قاعدة الكود واتركه يعمل خطوات أطول قبل أن يعود إليك.

حدود يجب أن تعرفها قبل الاعتماد عليه

  • Terminal-Bench لا يزال متأخراً: 26% مقابل 34.6% لـGPT-5.6 Sol Max. مهام سطر الأوامر الطويلة المعقدة ليست ملعبه الأقوى.
  • DeepSWE لصالح المنافسين: هندسة البرمجيات العميقة نقطة تفوق واضحة لـOpenAI وAnthropic في هذه الدفعة.
  • الأرقام ذاتية المنشأ: بانتظار تقييمات مستقلة أوسع لتأكيد الترتيب.
  • لا تفاصيل رسمية عن مستوى العربية: الإعلان لا يتضمن تقييمات لغوية للعربية؛ فريقنا لم يجد بياناً رسمياً يقيّد الجودة اللغوية، والتجربة العملية عبر Cursor أو OpenRouter هي الفيصل الحالي.
  • عرض الضعف انتهى: لا تحسب حساباتك على حصص الأسبوع الأول المضاعفة.

أسئلة شائعة

هل Grok 4.6 مجاني؟

النموذج نفسه يُستهلك عبر اشتراكات أو API مدفوعة: Cursor وGrok Build وOpenRouter وVercel وCloudflare وواجهة SpaceXAI للـAPI. لا يوجد مستوى مجاني معلن للنموذج في صفحة الإطلاق، وتكلفة الاستخدام عبر الـAPI تبدأ من 2 دولار لكل مليون رمز إدخال.

كم سعر Grok 4.6 مقارنة بالمنافسين؟

2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، ونسخة سريعة بضعف هذا السعر — بحسب صفحة الإطلاق الرسمية. هذا يضعه في الشريحة الاقتصادية لنماذج الصف الأول، مع تفاصيل أسعار المنافسين الرسمية في صفحات كل منهم.

هل Grok 4.6 أفضل من GPT-5.6؟

في بعض الاختبارات نعم وفي أخرى لا: يتعادل مع GPT-5.6 Sol Max في مؤشر الذكاء العام (61) ويتقدم عليه في CursorBench (69.9% مقابل 67.2%) وAPEX-Agents، بينما يتفوق GPT-5.6 Sol Max بوضوح في DeepSWE (73% مقابل 65.9%) وTerminal-Bench (34.6% مقابل 26%). الاختيار يعتمد على طبيعة عملك.

كيف أستخدم Grok 4.6 من السعودية أو الخليج؟

عبر نفس القنوات العالمية: اشتراك Cursor أو منصة Grok Build أو مفتاح API من SpaceXAI أو خدمة OpenRouter للدفع المسبق. لا توجد قيود جغرافية معلنة ضد دول الخليج في أي من هذه القنوات.

هل يدعم Grok 4.6 اللغة العربية؟

لا يتضمن إعلان الإطلاق أي تقييم رسمي لقدرات النموذج في العربية، ولا حزمة اختبارات لغوية شرق أوسطية ضمن الجدول المنشور. نماذج Grok السابقة تعاملت مع العربية بجودة متفاوتة، والتوصية العملية: اختبره بمهامك الفعلية عبر OpenRouter قبل الالتزام باشتراك.

الخلاصة

بعد أسبوع من إطلاقه، يبدو Grok 4.6 أذكى تحديثات SpaceXAI منذ نشأة السلسلة: قفزة موثقة عن الإصدار السابق في كل اختبارات الوكلاء، مقعد حقيقي على طاولة الصف الأول في البرمجة التحريرية، وتسعير يجعله الخيار الاقتصادي الافتراضي لمن يبني بالـAPI. في المقابل، لا يزال متأخراً في أعمق اختبارات الهندسة، وأرقامه بانتظار تحقق مستقل، ولا بيانات رسمية عن مستوى العربية. إن كنت مطوراً أو طالباً يبني مشروعاً حقيقياً بميزانية محدودة، فهذه هي الحجة الأقوى حتى الآن لتجربته هذا الأسبوع.

المصادر

ابدأ رحلتك مع Truescho الآن

قبل أن تختار نموذجاً لمشروعك القادم، تصفّح دليل Truescho لأدوات الذكاء الاصطناعي حيث نراجع الأدوات والنماذج التي تصلح فعلاً للطلاب والمهنيين العرب، وتابع تغطيتنا لآخر إصدارات النماذج مثل Qwen3.8 مفتوح المصدر وتقرير Hugging Face للنماذج المفتوحة.