
بقلم: ليلى | محررة أدوات المطورين · صوت تحريري بإشراف بشري
أصدر فريق Ollama الإصدار v0.32.9 في الحادي عشر من أغسطس 2025، وجاء التحديث محوره الرئيسي نموذج NVIDIA Nemotron 3.5 Lightning، وهو نموذج مفتوح المصدر يعتمد بنية mixture-of-experts (MoE) بحجم كلي يبلغ 30 مليار معامل، مع 3 مليارات معامل نشطة فقط عند الاستدلال.
ما يميّز هذا النموذج أنه صُمِّم خصيصاً لتشغيل الوكلاء الدائمين (always-on agents)، أي الأنظمة التي تعمل باستمرار في الخلفية دون انتظار مدخلات بشرية. يستهدف Nemotron 3.5 Lightning بيئات مثل OpenClaw وHermes Agent، ويعتمد على مكدس الأمان والإدارة المفتوح NVIDIA NemoClaw لتشغيل هذه الوكلاء بشكل آمن وموثوق. الفكرة هنا ذكية: ضخامة 30 مليار معامل تمنحك قدرة استدلالية عالية، لكن تفعيل 3 مليارات فقط في كل مرة يجعل التشغيل المحلي قابلاً للتطبيق حتى على أجهزة غير متخصصة.
لتجربته مباشرة عبر Ollama، يكفي أمر واحد:
ollama run nemotron-3.5-lightningإلى جانب الدعم الجديد لبنية Nemotron 3، يتضمن الإصدار إصلاح حالة حدودية في محلل استدعاء الدوال الخاص بـ Muse Glimmer، وهو النموذج الذي أضافه الإصدار السابق v0.32.8 مع دعم لبطاقات NVIDIA وAMD وجميع المنصات. الإصلاح يعني أن استدعاء الأدوات عبر Muse Glimmer بات أكثر استقراراً في الحالات الطرفية التي كانت تُخفق سابقاً.
مجمل التغييرات في هذا الإصدار (وفقاً لـ GitHub changelog) تبقى محدودة — commit واحد فقط منذ الإصدار السابق — لكن إضافة نموذج بهذا المستوى إلى المنظومة المحلية لـ Ollama تفتح أمام المطوّرين إمكانية بناء وكلاء ذكاء اصطناعي دائمي التشغيل دون الاعتماد على APIs سحابية، وهو ما يظل ميزة جوهرية لمن يهتم بالخصوصية أو تكلفة الاستخدام المستمر.





