أعلنت شركة كاكاو أن سلسلة نموذج اللغة الخفيف الوزن (SLM) "كانانا-2 (Kanana-2)" المُطلقة كمشروع مفتوح المصدر حققت المرتبة الأولى في التقييم الشامل للسلامة الأمنية، متفوقةً على نماذج عالمية رائدة في الفئة ذاتها من حيث الحجم.
قامت كاكاو بتقييم النموذجين "كانانا-2-1.3B-Instruct" و"كانانا-2-3B-Instruct" اللذين تم إطلاقهما مفتوحة المصدر على منصة هوجنغ فيس في الثامن والعشرين من الشهر الماضي، من خلال منصة تقييم السلامة الأمنية للذكاء الاصطناعي التي طورتها الشركة بنفسها، حيث تم قياس الضرر والانحيازات بشكل منهجي.
استخدم التقييم معيار السلامة المتخصص باللغة الكورية "آشور AI" (Assur AI) الذي تم بناؤه بشكل مشترك من قبل وزارة العلوم والتكنولوجيا وتكنولوجيا المعلومات والاتصالات والجمعية الكورية لتكنولوجيا المعلومات والاتصالات (TTA) ومعهد كايست (KAIST) وكاكاو في نوفمبر من العام الماضي كجزء من مشروع حكومي. تم تصميم آشور AI لمراعاة السياق الاجتماعي والثقافي الكوري، مما يمكّنه من قياس عوامل الخطر في الذكاء الاصطناعي عبر ظروف متنوعة تشمل المحتوى النصي والصور والصوت والمحتوى متعدد الأنماط، بالإضافة إلى سيناريوهات الاستخدام الفعلي للخدمات والاستفسارات الخبيثة.
يتضمن معيار آشور AI ما مجموعه 9560 عنصر تقييمي موزع على 35 فئة خطر. أعادت كاكاو تنظيم هذه الفئات إلى خمس فئات رئيسية: △المخاطر الاجتماعية △المحتوى الجنسي وحماية الأطفال △الجرائم والأعمال غير القانونية △العنف △انتهاكات الحقوق. طبقت كاكاو منهجية "LLM-as-a-Judge" حيث يقيّم نموذج الذكاء الاصطناعي الردود وفقاً لمعايير التصنيف المحددة مسبقاً، مما يقلل التباين الذاتي حتى في التقييمات واسعة النطاق.
تم اختيار نموذجي جوجل "جيما" وعلي بابا "كيوين" كنماذج مقارنة بحجم معاملات مماثل. حققت كانانا-2-1.3B-Instruct درجة شاملة قدرها 0.70، متفوقة على جيما (0.68) وكيوين (0.58)، في حين حققت كانانا-2-3B-Instruct أيضاً درجة 0.70، وهي أعلى من جيما (0.66) وكيوين (0.62).
على مستوى الفئات الرئيسية، أظهر نموذج كانانا بحجم 1.3B تفوقاً في مجال الجرائم والأعمال غير القانونية، بينما تفوق نموذج 3B بشكل كبير على النماذج المقارنة في مجالات المحتوى الجنسي وحماية الأطفال وانتهاكات الحقوق.
تخطط كاكاو، بناءً على هذا التقييم، لتطبيق تقييمات السلامة الأمنية الاستباقية بشكل منتظم على نماذج الذكاء الاصطناعي المطورة ذاتياً والتي ستطلقها مستقبلاً. تنوي الشركة توسيع نطاق التقييم تدريجياً ليشمل نماذج متعددة الأنماط وتقييمات مخاطر الذكاء الاصطناعي الوكيل، متجاوزة نماذج اللغة المستندة على النصوص.
قال كيم كيونغ-هون، قائد قسم السلامة الأمنية للذكاء الاصطناعي في كاكاو: "يمثل هذا التقييم حالة نموذجية لفحص السلامة الأمنية للنماذج مفتوحة المصدر بشكل استباقي من خلال نظام التحقق الخاص بنا والإفصاح عن النتائج. سنستمر في تطبيق مبادئ تطوير الذكاء الاصطناعي المسؤول وجعل التحقق من السلامة الأمنية جزءاً أساسياً من عملية إطلاق النموذج".
* تمت ترجمة هذا المقال تلقائيًا بواسطة الذكاء الاصطناعي.
