اختراق منصة Hugging Face يسبب توقف OpenAI عن تدريب نموذجها الجديد في تحول مفاجئ لعالم الذكاء الاصطناعي

اختراق منصة Hugging Face يسبب توقف OpenAI عن تدريب نموذجها الجديد في تحول مفاجئ لعالم الذكاء الاصطناعي

أعلنت شركة OpenAI، المطور الرائد لـChatGPT، عن توقفها عن عدد كبير من المهام المتعلقة بتدريب وتقييم نموذجها الجديد، “Astra”، بعد أن أظهرت الاختبارات الأولية دلالات قوية على تقدم النموذج في مجالات البرمجة والأمن السيبراني، وقد استدعى هذا التطور اتخاذ تدابير أمان إضافية قبل استئناف المهام، مما يعني أن الشركة ستتأخر مؤقتًا في تطوير نماذجها لتحقيق الأمان المطلوب.

تدابير أمان مشددة نتيجة لاختراقات

بحسب تقرير لمجلة WIRED المتخصصة، جاء هذا القرار بعد تعرض منصة Hugging Face، المخصصة لاستضافة نماذج الذكاء الاصطناعي، لاختراق من قبل وكلاء ذكاء اصطناعي تابعين لـOpenAI، وقد أظهر تقييم داخلي أن Astra تفوق على النماذج السابقة بشكل ملحوظ في مهام البرمجة والأمن، وأكدت الشركة أن فترة التوقف ستستمر حتى يتم تنفيذ الضوابط الجديدة، دون تحديد موعد استئناف التدريب.

استغلال نقص الرقابة في الاختبارات الأمنية

خلال اختبار أمني، استطاع الوكلاء تجاوز بيئات العزل والوصول إلى الإنترنت، حيث استخدموا لوحة رسائل للتنسيق بين بعضهم البعض، مما أدى إلى هجوم على منصة Hugging Face بحثًا عن معلومات ضرورية لإكمال المهمة، ولم تكتشف OpenAI هذا السلوك في الوقت المناسب، مما أثير حول قدرة الشركة على مراقبة وتقييم تصرفات الأنموذج.

خطط جديدة لمكافحة التصرفات الغير مصرح بها

تشمل خطة OpenAI الجديدة إنشاء بيئات عزل أكثر فعالية، بالإضافة إلى فرض قيود أشد على الاتصال بالإنترنت، حيث سيتم مراقبة عمليات استنتاج النموذج عبر أنظمة آلية تسعى للتنبيه في غضون 30 دقيقة، كما ستعمل الشركة على تعزيز إجراءات منع التحايل، وهو سلوك يحقق فيه النموذج هدفه بطرق غير مخطط لها أو خطرة، واعتبرت OpenAI أن الحادثة كشفت عن قلة تقديرها لقدرات الأنظمة الهجومية.