وزارة العلوم والتكنولوجيا والاتصالات تعلن نتائج التقييم المرحلي الثاني لمشروع نموذج أساس الذكاء الاصطناعي الموحد
تضاءلت المنافسة النهائية لمشروع نموذج أساس الذكاء الاصطناعي الموحد (الدولار) ليشمل ثلاثة فريق فقط: أبستيج وإس كي تي (تلكوم) وأل جي لأبحاث الذكاء الاصطناعي. فيما فشلت شركة موتيف تكنولوجيز، التي انضمت إلى المشروع عبر دعوة إضافية، في تخطي حاجز التقييم المرحلي الثاني.
أعلنت وزارة العلوم والتكنولوجيا والاتصالات (وزارة العلوم) والمعهد الوطني لتعزيز صناعة تكنولوجيا المعلومات والاتصالات (NIPA) يوم الثامن عشر عن نتائج التقييم المرحلي الثاني لمشروع نموذج الذكاء الاصطناعي الموحد. أسفرت نتائج التقييم عن استبعاد موتيف، وتأهل كل من أبستيج وإس كي تي وأل جي لأبحاث الذكاء الاصطناعي للمرحلة التالية.
ووفقاً لوزارة العلوم، تضمن التقييم المرحلي الثاني معادلة مركبة من ثلاثة عناصر: تقييم المقاييس المرجعية (40 نقطة)، والتقييم من قبل الخبراء (35 نقطة)، وتقييم المستخدمين (25 نقطة).
تألف تقييم المقاييس المرجعية من 25 نقطة من مؤشر الذكاء (AAII) الصادر عن شركة أرتيفيشيال أناليسيس (AA)، و15 نقطة من مقاييس المعهد الوطني للمعلومات (NIA). استخدم تقييم AAII تسع معايير عالية الصعوبة تشمل مجالات وكيل ذكي وترميز البرامج والمعلومات العامة والعلوم. شمل تقييم معايير NIA بشكل أساسي مجالات الرياضيات والمعرفة وفهم النصوص الطويلة والامتثال للتعليمات والعربية والاستقرار والموثوقية.
بلغ متوسط نقاط الفريق الأربعة المتنافس في تقييم المقاييس المرجعية 22.5 نقطة. وكان الفارق بين المركز الأول والرابع 4.0 نقاط.
أجرى تقييم الخبراء لجنة خبراء مشكلة من متخصصين خارجيين في مجال الذكاء الاصطناعي. استمر التقييم العميق لمدة أسبوع تقريباً، وغطى ثلاثة محاور بناءً على الوثائق المقدمة من الفريق المتنافس: استراتيجية التطوير والتكنولوجيا (10 نقاط)، وإنجازات التطوير والخطط المستقبلية (10 نقاط)، والآثار الإيجابية وخطط المساهمة (15 نقطة). ضمت لجنة الخبراء عشرة متخصصين يتمتعون بخبرة في مجالات خوارزميات الذكاء الاصطناعي والخدمات والبيانات، دون أي تضارب في المصالح.
بلغ متوسط نقاط الفريق الأربعة في التقييم من قبل الخبراء 28.8 نقطة. وكان الفارق بين المركز الأول والرابع 2.4 نقطة.
تألف تقييم المستخدمين، الذي طُبق لأول مرة في هذه المرحلة من التقييم، من عنصرين: تقييم المستخدمين المتخصصين في الذكاء الاصطناعي (15 نقطة) وتقييم عامة الجمهور (10 نقاط). شارك في تقييم المستخدمين المتخصصين 49 شخصاً، من بينهم رؤساء شركات ناشئة متخصصة في الذكاء الاصطناعي، فيما شارك في تقييم عامة الجمهور 185 شخصاً. صُممت هذه المرحلة لتقييم شامل للقابلية الفعلية للاستخدام والفائدة كما يشعر بها مستخدمون متنوعون يستخدمون النموذج مباشرة، بدلاً من الاقتصار على تقييم الأداء التقني للنموذج وحده.
بلغ متوسط نقاط الفريق الأربعة في تقييم المستخدمين 17.6 نقطة. وكان الفارق بين المركز الأول والرابع 5.0 نقاط، وهو فارق أكبر من ذلك الملحوظ في تقييم المقاييس المرجعية والتقييم من قبل الخبراء.
من جانب آخر، تعتزم وزارة العلوم توسيع دعمها للفريق المتأهل للمرحلة التالية من المشروع بتوفير معالجات الرسومات عالية الأداء من طراز B200.
قالت الوزارة: "نحن ندرك بعمق ضرورة امتلاك نموذج ذكاء اصطناعي موحد من أعلى المستويات، ونناقش حالياً مع الجهات الحكومية ذات الصلة أنظمة دعم جديدة تتجاوز الأساليب التقليدية. ونعتزم الإعلان عن التفاصيل المحددة لاحقاً."
* تمت ترجمة هذا المقال تلقائيًا بواسطة الذكاء الاصطناعي.
