Nvidia Nemotron 3.5 Lightning: نموذج 30 مليار معامل مفتوح للوكلاء الأذكياء بأداء أسرع 4 مرات 2026
آخر تحديث: 12 أغسطس 2026
في 11 أغسطس 2026، أعلنت Nvidia عن إصدار نموذج Nemotron 3.5 Lightning، وهو نموذج خبير مُختلط (MoE) بحجم 30 مليار معامل ومُصمَّم خصيصاً لتشغيل الوكلاء الأذكياء (AI Agents). إلى جانبه أطلقت مكتبة NeMo Switchyard مفتوحة المصدر لتوجيه مهام الوكلاء عبر النماذج المختلفة تلقائياً. الخبر يهمّ كل مطوّر عربي يبني تطبيقات ذكاء اصطناعي تعمل لساعات طويلة دون تدخّل بشري.

ما الذي أُعلن عنه بالضبط؟
الإعلان رسمي ومنشور على مدونة Nvidia بتاريخ 11 أغسطس 2026، ويتضمن ثلاثة عناصر أساسية:
- نموذج Nemotron 3.5 Lightning — نموذج مفتوح الأوزان (open weights) بحجم 30 مليار معامل، بمعمارية Mixture-of-Experts تنشط منها 3 مليار معامل فقط لكل استدعاء. هذا التصميم يُسرّع الاستدلال دون التضحية بجودة المخرجات.
- NeMo Switchyard — مكتبة مفتوحة المصدر على GitHub لتوجيه (routing) كل مهمة وكيل ذكي إلى النموذج الأنسب من حيث الجودة والتكلفة والسرعة. وفقاً لـ Nvidia، فإن Switchyard يحافظ على دقة النماذج الحديثة مع خفض تكلفة إكمال المهمة إلى ثلث ما يكلفه استخدام Claude Opus 4.8 وحده.
- مجموعة بيانات Nemotron-RL-Agentic-Terminal-Pivot — مجموعة بيانات التعلم المعزز للوكلاء، متاحة على Hugging Face، تتيح للمطوّرين تخصيص النموذج لمجالاتهم.
وفقاً للمصدر الرسمي، يقدّم النموذج سرعة مخرجات أسرع حتى 4 مرات وإكمال مهام وكلاء أسرع بنسبة 30% مقارنة بالنماذج المنافسة في فئته.
لماذا هذا الخبر مهم للمطورين والشركات العربية؟
التشغيل المحلي على أجهزة RTX
أهم ما يميز Nemotron 3.5 Lightning هو أنه مُصمَّم ليعمل محلياً على أجهزة Gamers والمحترفين التي يملكها كثير من المطوّرين العرب:
- بطاقات Nvidia RTX بمختلف فئاتها
- محطة عمل DGX Spark الشخصية
- محطة DGX Station الاحترافية
- منصة Jetson للحوسبة الطرفية (الروبوتات والكاميرات الذكية)
- أجهزة RTX PRO workstations
هذا يعني أن مطوّراً في الرياض أو القاهرة أو دبي يستطيع تشغيل نموذج 30 مليار معامل على جهازه الخاص دون إرسال بياناته إلى سحابة أجنبية — وهو ما يُعالج مخاوف السيادة الرقمية وحماية البيانات التي تفرضها قوانين مثل قانون حماية البيانات الشخصية السعودي (PDPL) وقانون دبي لحماية البيانات.
تكامل مع أدوات مفتوحة المصدر
النموذج منشور برابط رسمي على Hugging Face، ومتاح للتجربة المجانية على OpenRouter، وقابل للتشغيل المباشر عبر build.nvidia.com. واجهات API مفتوحة، والأوزان قابلة للتحميل والتعديل دون قيود.

مقارنة سريعة: Nemotron 3.5 Lightning مقابل البدائل
| المعيار | Nemotron 3.5 Lightning | Claude Haiku 4.5 | GPT-5.6 Mini | Gemini 3.6 Flash |
|---|---|---|---|---|
| عدد المعاملات | 30B (3B نشطة) | غير معلن | غير معلن | غير معلن |
| التشغيل المحلي | نعم (RTX) | لا | لا | لا |
| رخصة الأوزان | مفتوحة | مغلقة | مغلقة | مغلقة |
| التوجيه التلقائي (Switchyard) | نعم | لا | لا | لا |
| التكلفة النسبية للمهمة | الأقل | متوسطة | متوسطة | متوسطة |
| مناسب لـ | الوكلاء طويلو الأمد | المحادثة العامة | المحادثة العامة | المهام متعددة الوسائط |
الفئة المستهدفة من Nemotron 3.5 Lightning ليست المحادثة السريعة — بل الوكلاء الأذكياء الذين ينفّذون سلاسل مهام متعددة الخطوات لساعات: مراجعة أكواد برمجية كاملة، تحليل عقود قانونية، بحث عميق، أو تشغيل روبوت محادثة يدعم عملاء مؤسسة كبيرة.
شركاء الإطلاق
أكّدت Nvidia تبنّي شركات كبيرة لـ Nemotron 3.5 Lightning وNeMo Switchyard منذ اليوم الأول، من بينها:
- CrowdStrike للأمن السيبراني
- Harvey لمنصات الذكاء الاصطناعي القانوني
- CodeRabbit لمراجعة الأكواد البرمجية
- Boomi لدمج الأنظمة المؤسسية
- LangChain لإطار عمل الوكلاء الأذكياء
- Cognition لوكيل البرمجة Devin
- Siemens للأتمتة الصناعية
- Ramp لإدارة النفقات المؤسسية
استخدام LangChain للنموذج مهم بشكل خاص لأن أغلب المطوّرين العرب الذين يبنون وكلاء ذكاء اصطناعي يعتمدون على هذه المكتبة.

ماذا يعني هذا لك؟
إذا كنت مطوّراً فردياً في الخليج أو العالم العربي
- ابدأ تجربة النموذج مجاناً على OpenRouter لتقييم جودته على مهمتك دون الالتزام ببنية تحتية.
- حمّل الأوزان من Hugging Face إذا كان لديك بطاقة RTX بسعة ذاكرة 16GB على الأقل، واستخدم أداة مثل
llama.cppأوvLLMلتشغيله محلياً. - ادمج NeMo Switchyard في مشروعك الحالي إذا كنت تستخدم أكثر من نموذج — ستوفّر تكاليف API بنسبة قد تصل إلى 67% وفقاً للأرقام الرسمية.
إذا كنت شركة ناشئة أو مؤسسة
- السيطرة على البيانات: تشغيل Nemotron محلياً يمنع تسريب بيانات العملاء إلى أي طرف خارجي — متطلب أساسي في قطاعات الصحة والمالية والحكومي.
- تكلفة منخفضة: Switchyard يخفّض التكلفة إلى ثلث ما تدفعه لـ Claude Opus 4.8 وحده مع الحفاظ على الدقة — وفقاً لما تعلنه Nvidia.
- قابلية التخصيص: مجموعة بيانات Nemotron-RL-Agentic-Terminal-Pivot تتيح لك ضبط النموذج (fine-tune) على بياناتك الخاصة دون الحاجة لعقد تجاري مع مختبر ذكاء اصطناعي.
كيفية الوصول من الدول العربية
النموذج لا يتطلب VPN أو بطاقة دفع أمريكية للتجربة الأولية:
- مجاني بالكامل على OpenRouter و build.nvidia.com
- تحميل مباشر من Hugging Face دون قيود جغرافية
- التشغيل المحلي لا يتطلب اتصالاً بالإنترنت بعد تحميل الأوزان
- لا يوجد حظر رسمي لأي دولة عربية، على عكس بعض خدمات OpenAI و Anthropic التي تحظر مصر والإمارات والسعودية بين فترة وأخرى
حدود يجب أن تعرفها
رغم الإيجابيات، هناك قيود يجب مراعاتها:
- حجم الذاكرة: تشغيل نموذج 30B يتطلب بطاقة رسوميات بسعة ذاكرة 16GB على الأقل (VRAM)، ويفضّل 24GB أو أعلى للأداء الأمثل.
- جودة اللغة العربية: Nvidia لا تنشر مؤشرات واضحة حول أداء Nemotron 3.5 Lightning في العربية، وعلى المطوّرين اختباره على حالات استخدام محددة بدلاً من افتراض جودة مماثلة للإنجليزية.
- التعقيد التشغيلي: Switchyard يضيف طبقة توجيه إضافية قد تزيد زمن الاستجابة الأولي، حتى لو خفضت التكلفة الكلية.
- التحديثات المستمرة: النموذج في إصدار أولي، وقد تتغير مؤشرات الأداء مع التحديثات — تابع صفحة Hugging Face الرسمية للحصول على آخر المراجعات.
كيف يختلف عن Nemotron 3.0؟
النموذج السابق من عائلة Nemotron كان يركّز على مهام المحادثة العامة. Nemotron 3.5 Lightning يعيد ضبط الأولوية نحو الوكلاء الأذكياء طويلي الأمد: المهمة التي تنفّذ 30 خطوة متتالية، وتحتاج إلى التفاعل مع أدوات خارجية (متصفح، قاعدة بيانات، API)، وتتحمل انتظار دقائق قبل إنتاج المخرجات النهائية. هذه الفئة من المهام لم تكن موثقة جيداً في النماذج السابقة.
الأسئلة الشائعة
هل أحتاج إلى اشتراك مدفوع لاستخدام Nemotron 3.5 Lightning؟
لا، النموذج مفتوح الأوزان ومتاح مجاناً للتحميل على Hugging Face، وللتجربة المباشرة على OpenRouter و build.nvidia.com. تحتاج فقط إلى دفع تكاليف البنية التحتية (بطاقة RTX أو خادم) إذا أردت تشغيله بنفسك.
ما الفرق بين Nemotron 3.5 Lightning وNeMo Switchyard؟
Nemotron 3.5 Lightning هو نموذج ذكاء اصطناعي. NeMo Switchyard هو مكتبة توجيه تنقل كل مهمة إلى النموذج الأنسب لها (سواء كان Nemotron أو Claude أو GPT أو غيرها). يمكنك استخدام Switchyard دون Nemotron والعكس.
هل يعمل النموذج على بطاقة RTX 3060 بذاكرة 12GB؟
تشغيل النموذج الكامل بـ FP16 يحتاج ذاكرة أعلى من 12GB. يمكنك استخدام نسخة NVFP4 المُضغوطة المنشورة على Hugging Face (نفس رابط المستودع) لتشغيله على بطاقات أقل ذاكرة، مع خفض طفيف في الجودة.
هل النموذج مناسب لتطبيقات خدمة العملاء باللغة العربية؟
Nemotron 3.5 Lightning مُدرَّب أساساً على الإنجليزية والمهام البرمجية والإدارية. للعربية، يُنصح بإجراء اختبار دقيق على عيّنة من استفسارات عملائك. للحالات الحرجة، قد تكون نماذج مثل ALLaM أو Jais (المُدرَّبة خصيصاً للعربية) أنسب.
كيف أبدأ في تكامل NeMo Switchyard في مشروعي؟
المكتبة متاحة على GitHub ضمن منظومة NVIDIA-NeMo. ادخل إلى مستودع Switchyard، اتبع دليل التثبيت، وابدأ بتجربة توجيه بسيط بين نموذجين (مثلاً Claude و Nemotron) لقياس الفرق في التكلفة والجودة.
الخلاصة
إطلاق Nvidia لـ Nemotron 3.5 Lightning و NeMo Switchyard يضع أساساً جديداً لبناء وكلاء ذكاء اصطناعي منخفضي التكلفة وقابلين للتشغيل محلياً — وهو ما يجعله ذا أهمية خاصة للمطوّرين والشركات في العالم العربي الذين يبحثون عن بدائل مفتوحة لنماذج Anthropic و OpenAI المغلقة. التجربة المجانية على OpenRouter وبناء العلاقات الرسمية مع شركاء مثل LangChain يجعلان حاجّة الدخول منخفضة جداً. ابدأ بتجربة صغيرة على مهمة فعلية لديك، وقِس الأداء والتكلفة، ثم قرّر التوسّع.
للاطلاع على المزيد من تغطيتنا لأخبار الذكاء الاصطناعي، يمكنك قراءة تحليلنا لنموذج Qwen 3.8-Max من Alibaba، أو شرحنا لنموذج Kimi K3 مفتوح المصدر.