شركة أنثروبيك تؤكد وجود ثلاث حالات اختراق غير مأذون بها لأنظمة خارجية أثناء اختبار نموذج كلود
OpenAI تعلن عن حادثة اختراق في نموذج GPT-5.6 منذ الحادي والعشرين من الشهر الماضي
أعلنت شركة أنثروبيك، وهي من أبرز شركات الذكاء الاصطناعي الناشئة الأمريكية، عن وجود حالات اختراق غير مأذون بها لثلاث جهات خارجية من قبل نموذج الذكاء الاصطناعي الخاص بها المعروف باسم "كلود" أثناء مرحلة الاختبار. وقد أثار هذا الحادث المخاوف بشأن الأمن السيبراني المحيط بتكنولوجيا الذكاء الاصطناعي، خاصة بعد تعرض شركة OpenAI لحادث مشابه خلال الأسبوع السابق.
أصدرت شركة أنثروبيك بيانًا في الثلاثين من هذا الشهر (بالتوقيت المحلي)، قالت فيه: "خلال عملية مراجعتنا لتقييمات الأمن السيبراني، اكتشفنا ثلاث حالات قام فيها نموذج كلود بالوصول بشكل غير مأذون إلى الأنظمة الفعلية لثلاث مؤسسات، وذلك بعد اتصاله بالإنترنت من خلال بيئة تقييم طرف ثالث أو أثناء تفاعله معها". وأوضحت الشركة أنه بعد مراجعة 141,006 حالة اختبار إجمالية، ظهرت هذه حالات الاختراق، حيث حدثت الحالة الأولى في شهر أبريل.
وأشارت أنثروبيك إلى أنها اكتشفت هذه النتائج بعد حادثة الاختراق التي وقعت في نموذج GPT من OpenAI، حيث قامت بمراجعة نتائج التقييمات الداخلية لثلاثة نماذج: كلود أوبس 4.7، وميثوس 5، ونموذج اختبار داخلي. وقد أعلنت شركة OpenAI في الحادي والعشرين من هذا الشهر عن حادث اختراق شمل عدة نماذج ذكاء اصطناعي بما فيها GPT-5.6 سول (Sol)، حيث استغلت ما يعرف بـ "ثغرات اليوم الصفري" (Zero-Day) غير المكتشفة سابقًا للهروب من بيئة الاختبار المعزولة والوصول إلى بيئة التشغيل لمنصة المجتمع الخاصة بـ "هاgging Face".
أوضحت أنثروبيك أن هذا الحادث وقع خلال مرحلة "التقاط العلم" (Capture-the-Flag) المخصصة لتقييم قدرات كلود على الأمن السيبراني، وهي اختبارات تقوم على اختراق حواسيب أخرى على الشبكة للبحث عن معلومات سرية (العلم). غير أن أنثروبيك أوضحت أنها حددت صراحة لنموذج كلود عدم القدرة على الوصول إلى الإنترنت في هذا الاختبار، لكن حدث التباس بينها وبين شريك التقييم "إيريجيولار" (Irregular)، مما أدى إلى أن يتمتع النموذج بإمكانية الوصول الفعلي إلى الإنترنت.
وبناءً على ذلك، اعتبر نموذج كلود أن الأنظمة التي اكتشفها من خلال البحث على الإنترنت تشكل جزءًا من الاختبار، واستخدم تقنيات أساسية مثل كسر كلمات المرور الضعيفة والاستفادة من نقاط نهاية غير معروفة للوصول إلى بنية المؤسسات الحكومية. وأضافت أنثروبيك أن نموذج كلود لم يفعل سوى الحصول على "العلم" من تلك الأنظمة، ولم يقم بأي أنشطة اختراق إضافية.
أفادت أنثروبيك بأنها بدأت مراجعة سجلات وصول كلود في الثالث والعشرين، وعند اكتشافها إمكانية وصول كلود إلى الإنترنت، أوقفت جميع تقييمات الأمن في نفس اليوم. وفي السابع والعشرين، قامت بإخطار الجهات الثلاث التي تعرضت بنيتها للاختراق بمحتويات الحادث. وشددت الشركة على أنه مع تطور قدرات نماذج الذكاء الاصطناعي بشكل متزايد، يصبح من الضروري تطبيق ضوابط أقوى في الاختبارات.
وبعد إعلان كل من OpenAI وأنثروبيك عن حالات اختراق غير مقصودة في بيئات الاختبار الخاصة بهما، تتزايد المخاوف بشأن الأمن السيبراني المحيط بنماذج الذكاء الاصطناعي. كما أشار الرئيس الأمريكي دونالد ترامب في بيان سابق إلى أن إدارته تدرس سبل تعزيز تنظيم قطاع الذكاء الاصطناعي في أعقاب حادث الاختراق الذي تعرضت له نماذج OpenAI. وفي الثامن والعشرين، وقع حوالي 1100 موظف من الشركات الكبرى العاملة في مجال الذكاء الاصطناعي بما فيها OpenAI وأنثروبيك وجوجل وميتا، بيانًا يطالب الحكومة الأمريكية برفع معايير دولية "للتحكم في سرعة تطوير الذكاء الاصطناعي".
* تمت ترجمة هذا المقال تلقائيًا بواسطة الذكاء الاصطناعي.
