Cerebras وOpenAI تطلقان GPT-5.6 Sol Ultrafast: 750 رمز في الثانية — أسرع نموذج ذكاء اصطناعي في العالم 2026
في الثالث عشر من أغسطس 2026، أعلنت شركة Cerebras Systems بالتعاون مع OpenAI عن إطلاق "Ultrafast Mode" لنموذج GPT-5.6 Sol عبر واجهة OpenAI API. النتيجة؟ سرعة قياسية تصل إلى 750 رمز (token) في الثانية الواحدة — وهو ما يصفه الإعلان بأنه يجعل GPT-5.6 Sol "أسرع نموذج ذكاء اصطناعي طليعي في العالم". هذا الرقم ليس مجرد تحسين تدريجي؛ إنه قفزة نوعية تنقل الاستدلال اللغوي إلى عصر جديد تختفي فيه زمن الانتظار تقريباً، مما يفتح أبواب حالات استخدام كانت غير عملية حتى الأمس القريب: استجابة فورية لانقطاعات الإنتاج، كشف سيبراني لحظي، ووكلاء ذكاء اصطناعي ينفذون سلاسل طويلة من المهام في ثوانٍ بدلاً من دقائق.
تفاصيل الشراكة والإعلان
نُشر الإعلان الرسمي على مدوّنة Cerebras بتاريخ 13 أغسطس 2026، من تأليف Joyce Er من فريق Cerebras. الشراكة تجمع بين بنية Cerebras المعمارية الفريدة — محرك Wafer-Scale Engine (WSE) الذي يضع 44 غيغابايت من ذاكرة SRAM مباشرة على رقاقة بحجم شريحة سيليكون كاملة — وبين نموذج GPT-5.6 Sol من OpenAI. الفكرة الجوهرية بسيطة لكن تنفيذها معقّد: بدلاً من نقل أوزان النموذج ذهاباً وإياباً بين الذاكرة والمعالج كما تفعل بطاقات GPU التقليدية، تبقى الأوزان ثابتة على الرقاقة، وتتدفّق الرموز عبر طبقات النموذج الموزّعة على أرقاص السيليكون المتكاملة. هذا الإلغاء الجذري لعنق الزجاجة في نقل البيانات هو ما يُمكّن السرعة الهائلة.
حسبما ورد في تدوينة Cerebras، فإن Ultrafast Mode متاح حالياً في إصدار محدود (Limited Preview) لـ "مجموعة مختارة من العملاء"، مع وعد بتوسيع الوصول كلما نمت القدرات التشغيلية. يمكن للمطوّرين التسجيل في قائمة الانتظار عبر cerebras.ai/openai-ultrafast-signup، كما تتوفر صفحة المعاينة الرسمية على openai.com/index/previewing-ultrafast/.

مصدر: مدونة Cerebras الرسمية — 13 أغسطس 2026.
السرعة في سياقها: مقارنة مع المنافسين
لفهم حجم القفزة، إليك مقارنة بين GPT-5.6 Sol في وضع Ultrafast وأبرز المنافسين:
| النموذج | السرعة (رمز/ثانية تقريباً) | الملاحظات |
|---|---|---|
| GPT-5.6 Sol Ultrafast | حتى 750 | على بنية Cerebras WSE |
| GPT-5.6 Sol (قياسي على GPU) | ~50–80 | عبر بنية GPU تقليدية |
| Claude Fable 5 (Anthropic) | ~68 | حسب بيانات Artificial Analysis |
| Claude Opus 4.8 Fast | ~150 | وضع Fast من Anthropic |
مقارنةً بـ Claude Fable 5 من Anthropic، يُعدّ GPT-5.6 Sol Ultrafast أسرع بـ 11 ضعفاً، وذلك استناداً إلى سرعات مُبلَّغ عنها من منصّة Artificial Analysis. أما مقارنةً بـ Opus 4.8 في وضع Fast mode، فهو أسرع بـ 5 أضعاف. هذه الأرقام تعني أن مهمة توليد 100,000 رمز — وهو حجم رواية كاملة — يمكن إكمالها في أقل من دقيقتين ونصف على Ultrafast، بينما تستغرق عشرات الدقائق على البدائل الأخرى.
اختبار "آخر امتحان للبشرية": 2,500 سؤال في 11 ساعة
من أكثر الأرقام إثارة في الإعلان ما يتعلق بمعيار HLE (Humanity's Last Exam) — وهو اختبار يضم 2,500 سؤال بمستوى الدكتوراه يغطي مجالات علمية وتقنية متقدّمة. إليك النتيجة:
- GPT-5.6 Sol Ultrafast: أكمل الاختبار في 11 ساعة و11 دقيقة
- Claude Fable 5: احتاج 78 ساعة و27 دقيقة لنفس الاختبار
كلا النموذجين استخدم إعداد reasoning بدرجة xhigh، وكلاهما حقّق دقّة "قابلة للمقارنة" وفقاً للإعلان. الفارق الزمني الهائل — مع دقّة متكافئة تقريباً — هو ما دفع Cerebras لوصب النتيجة بأنها "دقّة قابلة للمقارنة بسرعة تزيد عن 7 أضعاف". أُجري اختبار Sol يوم 10 يوليو 2026، بينما أُجري اختبار Fable 5 خلال الفترة من 13 إلى 15 يوليو 2026.
معيار GDP-Val: تسريع شامل بدون خسارة جودة
السرعة الخام ليست كل شيء إذا تراجعت الجودة. هنا يأتي دور معيار GDP-Val الذي يقيس السرعة من البداية إلى النهاية (end-to-end) في سير عمل حقيقي. في اختبار أُجري يوم 31 يوليو 2026 باستخدام GPT-5.6 Sol مع وضع Ultrafast وreasoning متوسط داخل بيئة Codex، حقّق النظام تسريعاً شاملاً بمقدار 5.6 ضعف دون أي تدهور في جودة المخرجات. هذا يعني أن المطورين الذين يستخدمون النموذج لمهام برمجية أو تحليلية معقدة يحصلون على نفس النتائج، لكن في أقل من خمس الوقت.
البنية المعمارية: لماذا Cerebras مختلفة؟
السر يكمن في الاختلاف الجذري عن بنية GPU التقليدية. معالج Cerebras Wafer-Scale Engine لا يقسّم الرقاقة إلى وحدات صغيرة منفصلة، بل يستخدم شريحة سيليكون كاملة (wafer-sized chip) تدمج فيها 44 غيغابايت من ذاكرة SRAM. في تصميم GPU النمطي، تُخزَّن أوزان النموذج في ذاكرة HBM منفصلة عن المعالج، ويُستهلك وقت كبير في نقلها ذهاباً وإياباً مع كل عملية استدلال. في تصميم Cerebras، تبقى الأوزان على الرقاقة نفسها، وتتدفّق الرموز (tokens) عبر طبقات النموذج الموزّعة على الرقاقة كأنها خط تجميع مستمر. هذا التصميم يُلغي عملياً زمن نقل البيانات، وهو السبب الهيكلي للسرعة غير المسبوقة.
حالات الاستخدام: ما الذي يُمكنك فعله بـ 750 رمز/ث؟
الإعلان يذكر حالات استخدام محددة تتحوّل من "ممكنة نظرياً" إلى "عملية فعلاً" عند هذه السرعة:
- الاستجابة لانقطاعات الإنتاج (Production Outage Response): عندما تتعطّل خدمة حرجة، يمكن للنموذج تحليل لوجات النظام واقتراح حلول في ثوانٍ بدلاً من دقائق طويلة.
- الكشف السيبراني السريع (Cybersecurity Rapid Detection): تحليل تدفقات بيانات الشبكة وتحديد الأنماط المشبوهة في الوقت الفعلي تقريباً.
- وكلاء المهام (Agent Workflows): سلاسل طويلة من الخطوات — مثل "ابحث، حلّل، اكتب تقريراً، أرسل إيميلاً" — تُنجَز في ثوانٍ.
- الموجزات القانونية (Legal Briefs): تحليل آلاف الصفحات من الوثائق القانونية وتوليد موجز شامل في دقائق.
- النماذج المالية (Financial Models): بناء وتعديل نماذج مالية معقّدة بسرعة تسمح بالتكرار السريع.
- التقارير الهندسية (Engineering Reports): تحليل بيانات المشروع وتوليد تقارير تقنية مفصّلة.
اقتبس الإعلان الباحث في OpenAI Jeffrey Wang قائلاً: "الآن ينتهي [النموذج] قبل أن تتاح لي فرصة تبديل السياق (context-switch)". هذه العبارة تختصر تجربة المستخدم: الاختفاء شبه التام لزمن الانتظار يغيّر طريقة تفاعل المطور مع النموذج جذرياً.
ماذا يعني هذا لك؟ تأثير الشراكة على المطوّرين والشركات الناشئة في الخليج والعالم العربي
هذا السؤال عملي وليس نظرياً. إليك ما تحتاج معرفته:
متى يصل إلى المنطقة؟ لا يوجد جدول زمني رسمي لوصول Ultrafast Mode إلى مناطق محدّدة. الخدمة حالياً في معاينة محدودة لعملاء مختارين عالمياً، والتوسّع مرتبط بزيادة قدرة Cerebras التشغيلية. الشركات والمنصّات التي تستهلك واجهة OpenAI API برمجياً ستكون أول من يستفيد، لأن Ultrafast Mode يُطلَق أولاً في API — وليس في واجهة ChatGPT الاستهلاكية.
كيف تحصل على الوصول؟ خطوتان عمليتان:
- سجِّل في قائمة الانتظار عبر cerebras.ai/openai-ultrafast-signup باستخدام بريد عملك.
- تابع صفحة المعاينة على openai.com/index/previewing-ultrafast/ للتحديثات.
لا توجد رسوم معلنة حالياً — الإعلان لم يُفصح عن التسعير، وهذا أمر متوقع في مرحلة المعاينة المحدودة.
ماذا يعني للشركات الناشئة العربية؟ إذا كنت تبني منتجاً يعتمد على LLM — أداة كتابة، مساعد قانوني، منصّة تحليل بيانات، أو وكيل أتمتة — فإن السرعة تفتح أبواباً جديدة:
- منتجات وقت الاستجابة الحرج: تطبيقات تُظهر استجابة فورية للمستخدم بدلاً من شاشة تحميل.
- وكلاء متعدّدون الخطوات: تنفيذ سلاسل مهام معقدة في ثوانٍ، مما يُمكّن منتجات أوتومالية بالكامل.
- خفض تكلفة الانتظار: في سير عمل الفريق، تقليل زمن كل استدعاء من ثوانٍ إلى أجزاء ثانية يضاعف إنتاجية المطورين.
أنصح المطوّرين العرب بمتابعة أدوات الذكاء الاصطناعي على منصّتنا على /tools/ai حيث نُغطّي أحدث الأدوات المتاحة، وكذلك قراءة تحليلنا السابق عن GPT-5.6 Sol Luna المجاني على /blog/gpt-56-sol-luna-free-chatgpt-2026 لفهم الفروقات بين إصدارات عائلة GPT-5.6.
القيود التي يجب أن تعرفها
الإعلان مثير، لكن من المهم قراءته بعين واعية:
- معاينة محدودة: Ultrafast Mode ليس متاحاً للعموم حالياً. الوصول مقتصر على "مجموعة مختارة من العملاء" دون تفاصيل عن معايير الاختيار.
- لا تسعير علني: لم تكشف Cerebras أو OpenAI عن تكلفة Ultrafast Mode. من المرجّح أن يكون أعلى من الاستدلال القياسي على GPU، لكن لا توجد أرقام مؤكّدة.
- المعايير المعيارية داخلية: جميع القياسات (HLE، GDP-Val، السرعة مقابل Fable 5 وOpus 4.8) أُجريت داخلياً بواسطة Cerebras، وليس بواسطة طرف مستقل. يذكر الإعلان صراحةً: "قد تختلف تحسينات سرعة الاستدلال المرصودة مقابل أنظمة GPU اعتماداً على الحِمل والتكوين والتاريخ والنماذج المُختبَرة".
- البنية التحتية محدودة: Wafer-Scale Engine هي رقاقة متخصّصة غاية في التعرّق التقني، وطاقتها الإنتاجية محدودة بطبيعة الحال. هذا هو السبب في أن الوصول "سيتوسّع كلما نمت القدرة".
هذه القيود لا تُلغي أهمية الإعلان، لكنها تُذكِّرنا بأن السرعة المعلَنة قد تختلف في بيئات الإنتاج الحقيقية، وأن الوصول الواسع قد يستغرق وقتاً.
الأسئلة الشائعة
كم سرعة GPT-5.6 Sol في وضع Ultrafast؟
حتى 750 رمز في الثانية الواحدة، وفقاً لإعلان Cerebras الصادر في 13 أغسطس 2026. هذا يجعله، بحسب الإعلان، أسرع نموذج ذكاء اصطناعي طليعي في العالم. للمقارنة، هذا يعني توليد حوالي 1,125 كلمة في الثانية (بافتراض 1.5 رمز لكل كلمة بالإنجليزية).
كيف أحصل على Ultrafast Mode لـ GPT-5.6 Sol؟
سجِّل في قائمة الانتظار عبر cerebras.ai/openai-ultrafast-signup. الخدمة حالياً في معاينة محدودة لمجموعة مختارة من العملاء، ولم يُعلَن بعد عن موعد الوصول العام. يمكنك أيضاً متابعة صفحة المعاينة على openai.com/index/previewing-ultrafast/.
ما هو محرّك Wafer-Scale Engine من Cerebras؟
هو رقاقة بحجم شريحة سيليكون كاملة تُدمج فيها 44 غيغابايت من ذاكرة SRAM. على عكس GPU الذي يخزّن أوزان النموذج في ذاكرة منفصلة (HBM)، يُبقي WSE الأوزان على الرقاقة نفسها، وتتدفّق الرموز عبر طبقات النموذج. هذا التصميم يُلغي زمن نقل البيانات — وهو العنق الأساسي في الاستدلال على GPU.
هل GPT-5.6 Sol Ultrafast أسرع من Claude Fable 5؟
نعم، وفقاً لبيانات Cerebras. في اختبار HLE (آخر امتحان للبشرية)، أكمل GPT-5.6 Sol Ultrafast 2,500 سؤال في 11 ساعة و11 دقيقة، بينما احتاج Claude Fable 5 إلى 78 ساعة و27 دقيقة. هذا يجعله أسرع بـ 11 ضعفاً تقريباً استناداً إلى سرعات Artificial Analysis المُبلَّغ عنها.
ما تكلفة استخدام Ultrafast Mode؟
لم يُفصَح عن أي تسعير في الإعلان الرسمي. من المتوقّع أن تُعلَن التفاصيل السعريّة عند الانتقال من المعاينة المحدودة إلى الإتاحة الأوسع.
الخلاصة
شراكة Cerebras وOpenAI تمثّل لحظة فاصلة في سباق سرعة الاستدلال. الرقم — 750 رمز في الثانية — ليس تحسيناً تدريجياً بل قفزة من رتبة مغايرة. إذا تحقّقت الوعود في بيئات الإنتاج الحقيقية، فإن آفاق ما يمكن بناءه فوق هذه السرعة واسعة: وكلاء لحظيون، تحليل سيبراني في الزمن الفعلي، وتجربة مطوّر تتخلّص من الانتظار نهائياً. السؤال الآن ليس "هل هذا سريع؟" بل "متى يصبح متاحاً للجميع؟".

مصدر: Cerebras Systems — معالج WSE بـ 44 غيغابايت SRAM مدمجة.
المصادر
- Cerebras Blog — Accelerating GPT-5.6 Sol Ultrafast with OpenAI (13 أغسطس 2026، بقلم Joyce Er): https://cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai
- صفحة معاينة OpenAI الرسمية: https://openai.com/index/previewing-ultrafast/
- تسجيل قائمة انتظار Ultrafast: https://cerebras.ai/openai-ultrafast-signup
- Artificial Analysis — مقارنات سرعة النماذج: https://artificialanalysis.ai/