إنفيديا تبدأ الإنتاج الكامل لمسرّع الاستدلال "جروك3 إل بي إكس" لتسريع وكلاء الذكاء الاصطناعي

  • منصة فيرا روبين NVL72 توسع أداء الاستدلال...بمعدل 3400 رمز مولد في الثانية

  • شركات السحابة الذكية مثل نيفيوس تعتمد المسرّع...بدء المنافسة الفعلية على بنية الاستدلال

أعلنت إنفيديا في الخامس والعشرين من الشهر عن بدء الإنتاج الكامل لمسرّع الاستدلال 'جروك3 إل بي إكس'. [الصورة: إنفيديا]
أعلنت إنفيديا في الخامس والعشرين من الشهر عن بدء الإنتاج الكامل لمسرّع الاستدلال 'جروك3 إل بي إكس'. [الصورة: إنفيديا]

أعلنت إنفيديا عن بدء الإنتاج الكامل لمسرّع استدلال مختص بتسريع استجابة وكلاء الذكاء الاصطناعي، والمسمى 'جروك3 إل بي إكس'. وتعكس هذه الخطوة تطوراً في مجال البنية التحتية للذكاء الاصطناعي، حيث تتجاوز المنافسة مرحلة تحسين أداء المعالجة الحسابية للبيانات الضخمة، لتركز على تسريع 'معدل توليد الرموز'، وهو جوهر أداء وكلاء الذكاء الاصطناعي المتقدمة.

أعلنت إنفيديا عن الإنتاج الكامل لمسرّع جروك3 إل بي إكس خلال فعالية "هوت تشيبس" المنعقدة في مدينة سانتا كلارا بولاية كاليفورنيا الأمريكية في الخامس والعشرين من الشهر الجاري. يعد هذا المسرّع امتداداً متخصصاً لمنصة فيرا روبين الجديدة من إنفيديا، وهو مسرّع استدلال تفاعلي مخصص للذكاء الاصطناعي.

يقوم وكلاء الذكاء الاصطناعي بتنفيذ مهام معقدة من خلال تكرار عمليات استدلال متعددة واستدعاء أدوات مختلفة. وكلما زاد عدد الرموز المولدة في هذه العملية، كان معدل توليد الرموز الفردية أسرع، مما يؤثر بشكل مباشر على إجمالي وقت إنجاز المهمة. وقد أوضحت إنفيديا أن مسرّع جروك3 إل بي إكس موجه بشكل مركز نحو هذه النقطة الحاسمة.

كشفت إنفيديا عن مؤشرات الأداء أيضاً. وفقاً لإنفيديا، حقق مسرّع جروك3 إل بي إكس معدل 3400 رمز إخراج في الثانية الواحدة في اختبار قياسي (Artificial Analysis Benchmark) استهدف نموذج جيمّا4 31B مفتوح المصدر. وقد تم تحقيق هذا الأداء العالي تحت ظروف بسياق حجم 100 ألف رمز.

أشارت إنفيديا إلى أن مسرّع جروك3 إل بي إكس يوفر سرعة استجابة أسرع بحوالي 4 أضعاف مقارنة بمنصات مشابهة في المهام الحساسة للكمون الزمني، مثل البرمجة التعاونية المعتمدة على الذكاء الاصطناعي. وركزت الشركة على تقليل وقت المهام المتكررة التي يؤديها وكلاء الذكاء الاصطناعي، من كتابة واختبار الأكواد إلى مراجعة الملفات والتحقق من النتائج.

يقوم مسرّع جروك3 إل بي إكس بدور تكميلي في تعزيز أداء الاستدلال في منصة فيرا روبين NVL72. تدعم منصة فيرا روبين التدريب والاستدلال معاً للنماذج الذكية الضخمة. من خلال دمج مسرّع جروك3 إل بي إكس المتخصص في سرعة توليد الرموز، تستهدف البنية الهندسية تلبية متطلبي وكلاء الذكاء الاصطناعي الأساسيين: معالجة السياقات الضخمة والاستجابة في الوقت الفعلي.

بدأت شركات السحابة المتخصصة في الذكاء الاصطناعي بتبني هذا المسرّع. تخطط شركة نيفيوس لدمج جروك3 إل بي إكس في منصتها الإنتاجية للاستدلال المسماة 'نيفيوس توكن فاكتوري'. وستتيح هذه الخطوة للمطورين الاستفادة من خاصية توليد الرموز فائقة السرعة مع الحفاظ على واجهات البرمجة التطبيقية (API) الموجودة. وستكون شركة جروك المتخصصة في استدلال الذكاء الاصطناعي من بين أوائل الشركات المتبنية لهذا التقنية.

يحمل هذا الإنتاج الكامل أهمية خاصة في سياق تحول معايير المنافسة في البنية التحتية للذكاء الاصطناعي. مع تطور الذكاء الاصطناعي من مرحلة الإجابة على الأسئلة إلى مرحلة وكلاء ذكية قادرة على وضع خطط وتنفيذ مهام متعددة بشكل مستقل، بدأ يبرز كمؤشرات أداء مهمة: زمن الكمون والاستجابة بالإضافة إلى معدل توليد الرموز، بدلاً من مجرد حجم الحسابات.

تقوم إنفيديا بتطوير منصة فيرا روبين على مستوى الحوامل الكاملة (Rack Level)، حيث تجمع معالجات الوحدة المركزية وحدات معالجة البيانات (DPU) والتخزين وأنظمة الإيثرنت. تركز استراتيجية الشركة على تحسين جميع مكونات المنصة بما فيها جروك3 إل بي إكس بما يتناسب مع أحمال عمل وكلاء الذكاء الاصطناعي، مما يعزز مكانتها الريادية في سوق البنية التحتية للاستدلال بمراكز بيانات الذكاء الاصطناعي.




* تمت ترجمة هذا المقال تلقائيًا بواسطة الذكاء الاصطناعي.