تخطَّ إلى المحتوى

بيئة النماذج المفتوحة تتوسع: إنفيديا وميتا ومجتمع المطورين يطلقون وكلاء الذكاء الاصطناعي المحلي

شارك المقال
بيئة النماذج المفتوحة تتوسع: إنفيديا وميتا ومجتمع المطورين يطلقون وكلاء الذكاء الاصطناعي المحلي
الصورة: Nguyễn Duy Hưng / Unsplash

استمع لهذا المقال

بصوت ليلى (Layla)

تتسارع التطورات في منظومة الذكاء الاصطناعي المحلي مع إطلاق أنشطة شهر أغسطس التي تبرز تعاون شركة إنفيديا مع مجتمعات التطوير المفتوحة. يركز هذا التوجه على تمكين المطورين والمهتمين من بناء وتخصيص وتشغيل وكلاء الذكاء الاصطناعي على الأجهزة المحلية، اعتمادًا على حزمة جديدة من النماذج مفتوحة الأوزان والأدوات البرمجية والبنية التحتية للحوسبة المتسارعة التي تشمل بطاقات الرسوميات والمكتبات التعليمية والتطبيقات التخصصية.

ضمن هذه الإطلاقات، أعلنت إنفيديا عن نموذج «نيترون 3.5 لايتنينغ» (Nemotron 3.5 Lightning)، وهو نموذج مفتوح يعتمد على معمارية مزيج الخبراء بحجم 30 مليار معلمة ومخصص لوكلاء الذكاء الاصطناعي الذين يعملون بشكل مستمر. يحقق النموذج سرعة توليد رموز تصل إلى أربعة أضعاف مقارنة بالنماذج المفتوحة من فئته، مع تقليل زمن إكمال المهام بنسبة 30%. وتتيح طبيعته المفتوحة للمطورين إمكانية دوزنته لاتباع أساليب كتابة معينة، أو استيعاب مصطلحات مجالات مثل التصوير والتصميم ثلاثي الأبعاد، أو التكيف مع قواعد البرمجة المؤسسية. وتنسق إنفيديا مع إطارات تشغيل مثل vLLM وOllama وllama.cpp وLM Studio وUnsloth لتوفير أوزان بصيغتي NVFP4 وGGUF للأنظمة المحلية المتنوعة من بطاقات RTX حتى أنظمة DGX Spark وDGX Station.

ولمعالجة ارتفاع تكاليف استخدام الرموز البرمجية في بيئات المؤسسات دون التنازل عن مستوى الذكاء المطلوب، أطلقت إنفيديا مكتبة التوجيه مفتوحة المصدر «نيو سويتش يارد» (NeMo Switchyard). تعمل هذه المكتبة على توجيه كل خطوة في سير عمل الوكيل تلقائيًا إلى النموذج الأكثر ملاءمة بناءً على معايير الدقة والسرعة والتكلفة. وأظهرت الاختبارات المرجعية الداخلية أن المكتبة ساعدت في خفض تكلفة إنجاز المهام إلى ما يقارب ثلث تكلفة تشغيل نموذج Opus 4.8 بمفرده، مع المحافظة على دقة النتائج المتقدمة.

على صعيد متصل، طرحت شركة ميتا نموذج «ميوز غليمر» (Muse Glimmer)، وهو نموذج كثيف مفتوح الأوزان بحجم 30 مليار معلمة ونافذة سياق تمتد لأكثر من 120 ألف رمز، صُمم خصيصًا لمهام البرمجة والوكلاء المحليين. يستطيع النموذج توليد أكثر من 200 رمز في الثانية على حواسيب المكاتب المزودة ببطاقة NVIDIA RTX 5090، مما يتيح للوكلاء معالجة المستندات والرسائل الخاصة وتنفيذ مكالمات الأدوات المتعددة محليًا دون نقل البيانات السرية أو مفاتيح واجهات برمجة التطبيقات إلى السحابة.

دعمت إنفيديا هذا التوسع بتحديثات لتطبيق «إنفيديا سينك» (NVIDIA Sync) عبر خاصية مساعد العناقيد (Cluster Assistant)، والتي تتيح ربط جهازين أو أكثر من أنظمة DGX Spark عبر منافذ ConnectX 7 لتشكيل عنقود حوسبي مرتفع السرعة وتوزيع أحمال العمل تلقائيًا. كما أعلنت الشركة عن إتاحة متصفح كروم بنسخة Linux ARM64 الأصلية للتثبيت بنقرة واحدة من لوحة تحكم DGX Spark خلال شهر أغسطس، إلى جانب توفير أداة لمراقبة استخدام المعالج المركزي والمعالج الرسومي في الوقت الفعلي.

وشملت الإعلانات الموازية إطلاق نماذج وأدوات مفتوحة أخرى، بينها نموذج «كوزموس 3 إيدج» (Cosmos 3 Edge) بحجم 4 مليارات معلمة للروبوتات والمركبات المستقلة، ونموذج «ميني ماكس إتش 3» (MiniMax H3) التوليدي للفيديو والصوت المتزامن، ونموذج البرمجة «لاغونا إس 2.1» (Laguna S 2.1) بحجم 118 مليار معلمة من Poolside AI، ونموذج «ديب سيك في 4 فلاش» (DeepSeek V4 Flash) المحدث، ونموذج «إنكلينغ سمول» (Inkling Small) المتعدد الوسائط، وتطبيق «أنسلوث ديسكتوب» (Unsloth Desktop) الذي يجمع بين تدريب النماذج وتشغيلها محليًا، ونموذج «وان أنيميت 2» (Wan Animate 2) لنقل الحركة من علي بابا، ونموذج «إل تي إكس 2.5» (LTX 2.5) لتوليد الفيديو.

اشترك في همسات الذكاء الاصطناعي — كل أسبوع: قصص وفرص وأحداث مختصرة وموثقة، بلا حشو.

اشترك ليصلك الجديد