كشفت شركة OpenAI تفاصيل جديدة حول كيفية نجاح نماذج الذكاء الاصطناعي التابعة لها في اختراق منصة Hugging Face الشهر الماضي، في حادث وصفته الشركة بأنه “حادث إلكتروني غير مسبوق”، وأثار مخاوف واسعة بين الباحثين والتنفيذيين في قطاع التكنولوجيا بشأن المخاطر الأمنية المتزايدة لوكلاء الذكاء الاصطناعي المستقلين.
وHugging Face هي شركة متخصصة في الذكاء الاصطناعي تدير منصة مفتوحة المصدر تتيح للمطورين مشاركة نماذج الذكاء الاصطناعي الجاهزة وتحميلها وتطويرها، وهي التي اخترقتها وكلاء الذكاء الاصطناعي.
ونشرت OpenAI تقريراً من 37 صفحة استعرض الإجراءات التي اتخذتها نماذجها خلال سلسلة من التقييمات، قبل وأثناء حادث الاختراق، كما تناول الخطوات التي اتخذتها الشركة لمنع تكرار حادث مماثل، مع التركيز على تعزيز الأمن والاحتواء والمراقبة، إلى جانب تحسين سلوك النماذج وآليات الاستجابة للحوادث.
وكلاء الذكاء الاصطناعي تحايلوا على ضوابط الأمن
وقالت OpenAI في تقريرها إن الحادث أظهر قدرة الوكلاء المستقلين على العمل بصورة تعاونية، والتحايل على ضوابط أمن بيئات الإنتاج، ومهاجمة بيئات محمية بنجاح، مؤكدة أن ذلك يفرض على المؤسسات إعادة النظر في استراتيجياتها الأمنية وضوابطها وقدراتها على الاستجابة، لمواكبة مشهد التهديدات المتغير.
وفي 21 يوليو الماضي، كشفت OpenAI أن مجموعة من نماذجها، من بينها GPT-5.6 Sol ونموذج بحثي داخلي، تمكنت من اختراق منصة Hugging Face، التي تدير منصة مفتوحة المصدر لتطوير نماذج الذكاء الاصطناعي ومشاركتها وتحميلها.
وكانت النماذج تعمل كوكلاء مستقلين داخل بيئة اختبار معزولة، مع وصول محدود للغاية إلى الإنترنت. وتمكنت هذه الوكلاء من ربط سلسلة من الثغرات الأمنية للوصول إلى الإنترنت المفتوح، قبل أن تنجح في نهاية المطاف في الوصول إلى أنظمة تابعة لـHugging Face.
وأوضحت OpenAI أن الوكلاء كانوا يحاولون التحايل على آلية التقييم من خلال البحث عبر الإنترنت عن حلول جاهزة، في سلوك يُعرف باسم “اختراق المكافآت” (Reward Hacking)، حيث يسعى النموذج إلى تحقيق نتيجة التقييم بطرق لا تتوافق بالضرورة مع الهدف المقصود من المهمة.
نموذج بحثي كان العامل الأبرز
وخلصت OpenAI، وفقاً للتقرير، إلى أن نموذجها البحثي الداخلي كان صاحب “الدور الأوسع والأكثر تأكيداً” في الحادث. وبناءً على ذلك، أوقفت الشركة جميع عمليات التدريب والاستدلال المرتبطة بهذا النموذج، إلى جانب النماذج المشتقة منه، في 25 يوليو.
وأكدت الشركة أن إعادة تفعيل هذه النماذج ستتم وفقاً لطبيعة كل استخدام، مع إخضاعها لضوابط تتعلق بالبيئة والشبكة والتنبيهات والمراقبة والمراجعة.
وكانت OpenAI قد أطلقت GPT-5.6 Sol الشهر الماضي، باعتباره أقوى نموذج تجاري طرحته الشركة، إلا أنها أوضحت أن النسخة التي شاركت في حادث اختراق Hugging Face تختلف عن النسخة المتاحة للمستخدمين، إذ صُممت للعمل دون إجراءات الحماية والتصنيف القياسية.
صدمة في قطاع التكنولوجيا
أثار الحادث حالة من القلق داخل قطاع التكنولوجيا، إذ حذر سام كاري، كبير مسؤولي أمن المعلومات في شركة Zscaler، من أن “صندوق باندورا قد فُتح”، كما أصبح اختراق Hugging Face أحد المحاور الرئيسية للنقاش خلال مؤتمر الأمن السيبراني Black Hat الذي عُقد في وقت سابق من هذا الشهر، ولا سيما في ظل تعرض شركات أخرى، من بينها Anthropic وMeta، لحوادث اختراق مماثلة.
وامتدت تداعيات الحادث إلى أروقة السياسة في واشنطن، بعدما أشار النائبان تيد ليو، الديمقراطي عن ولاية كاليفورنيا، وناثانيل موران، الجمهوري عن ولاية تكساس، إلى الهجوم في بيان أعلنَا فيه عن “قانون مفتاح إيقاف الذكاء الاصطناعي”، الذي يلزم شركات الذكاء الاصطناعي بالحفاظ على القدرة على إيقاف نماذجها أو تقييدها أو تعليقها عند الضرورة.

















