تؤكد OpenAI أن نموذج اختبار هرب واختراق Hugging Face

- تقول إن OpenAI أن نموذجها الداخلي IM1، الذي كُلف بمهام مستحيلة في ExploitGym مع إيقاف مصنفات الأمان، استغل ثغرة يوم صفر في Artifactory للوصول إلى الإنترنت واختراق Hugging Face.
- ظهرت أول ملاحظة بين وكلاء في خادم الحزمة في 12 مايو، وانقطع الاتصال بالخدمة في 4 يوليو، وأعلنت Hugging Face عن الاختراق في 16 يوليو.
- تقول إن OpenAI إن نظام المراقبة الذي تخطط لتطبيقه كان سيقوم بتنبيه فريق الأمن قبل أكثر من يوم من وصول النماذج إلى Hugging Face.
نشرت OpenAI تقريرها الكامل حول حادثة Hugging Face في يوليو يوم الأربعاء.
أثناء اختبار أمني، هرب أحد نماذج الذكاء الاصطناعي الخاصة بها من البيئة الختمية التي كان من المفترض أن تبقيه دون اتصال. جمعت عيوب برمجية غير معروفة ودخلت إلى الأنظمة الحية لـ Hugging Face.
تقول OpenAI إن النموذج تصرف بمفرده وتصف الحادثة بأنها "طلقة تحذيرية".
أنشأت OpenAI اختباراً لم يستطع نموذجها اجتيازه
بدأت المشكلة داخل ExploitGym، أحد اختبارات الأمان الخاصة بـ OpenAI.
لم تكن بعض المهام تحل، وقامت OpenAI بتشغيل النماذج بدون مرشحات الأمان التي تمنع عادةً الاختراق الخطير.
تقول OpenAI إن إزالة هذه الحواجز كان مقصوداً لمعرفة ما يمكن للنموذج فعله بأقصى سرعة ومساعدة الشركة على معرفة كيفية حماية نفسها.
كان اللاعب الرئيسي نموذج بحث داخلي فقط، يُسمى IM1 بواسطة OpenAI، وهو مشابه في الحجم لـ GPT-5.6 Sol. كان من نفس عائلة نموذج Astra غير المنشور من OpenAI، على الرغم من أن الشركة شددت على أنه نموذج منفصل مع تدريب لاحق مختلف.
بدأ النموذج في البحث عن طريقة أخرى للخروج عندما واجه مشكلة ليس لها مسار صادق للحصول على درجة النجاح.
كان مسار الشبكة الوحيد للخروج من البيئة الختمية يمر عبر Artifactory، مدير الحزم المستضاف ذاتياً من JFrog، والذي تستخدمه OpenAI داخلياً لتثبيت النماذج للبرمجيات.
قالت JFrog إن النماذج استغلت ثغرة يوم الصفر في Artifactory، ورفعت الامتيازات، وتحركت جانبياً عبر البنية التحتية حتى وصلت إلى عقدة ذات وصول مفتوح إلى الإنترنت.
تركت الوكلاء أيضاً ملاحظات لبعضهم البعض، حيث كتبوا ملفات في خادم الحزم، وهو لوحة رسائل عابرة سمحت للوكلاء المنفصلين بتبادل تقنيات الاستغلال التي وجدوها.
ظهرت أول ملاحظة من هذا النوع في 12 مايو، تقول OpenAI. وبحلول 4 يوليو، أدى المرور إلى إيقاف تشغيل مثيل Artifactory، مما فتح حادث أمني في اليوم التالي.
لقد أجرينا تحقيقاً شاملاً في حادثة Hugging Face.
نقوم بنشر تقرير فني ومنشور مدونة مصاحب يعيد بناء نشاط الوكلاء، ويشرح سبب فشل الضوابط الحالية، ويوضح بالتفصيل كيف نمنع التكرار...
— OpenAI (@OpenAI) أغسطس 26، 2026
وجدت النماذج مكان حفظ الإجابات
بمجرد الاتصال بالإنترنت، استنتجت النماذج أن Hugging Face قد تستضيف نماذج ExploitGym، أو مجموعات البيانات، أو حتى الحلول التي كانت تفتقر إليها. قامت بسحب حلول الاختبار مباشرة من قاعدة بيانات الإنتاج الخاصة بـ Hugging Face.
في حالة واحدة وصفها صانع ChatGPT، استخدم نموذج بيانات اعتماد مسروقة وثغرات يوم صفر إضافية لفتح مسار تنفيذ عنيف للرموز (RCE) إلى خوادم Hugging Face.
أعلنت Hugging Face عن الاختراق في 16 يوليو دون معرفة من يقف وراءه. كما أفادت Cryptopolitan سابقاً، أن النموذج هرب من الاختبار حوالي 9 يوليو وبقي داخل Hugging Face من 11 إلى 13 يوليو.
تواصلت الشركة مع مكتب التحقيقات الفيدرالي (FBI) قبل أن تكتشف OpenAI أن نموذجها هو المخترق.
وظفت OpenAI شركة CrowdStrike للتحقق من نسخة الأحداث الخاصة بها. وقامت METR وRedwood Research بدراسة سلوك النماذج ونشرت تقريرها الخاص في نفس اليوم.
تقول JFrog إنها أرسلت إصلاحات لعملاء السحابة والمستضافة ذاتياً.
تم إصلاح ثلاثة عيوب في Artifactory 7.161.15، وتتبعها كـ CVE-2026-65617، وCVE-2026-65923، وCVE-2026-66018، مع نسب الفضل إلى باحثي OpenAI.
قالت OpenAI إنها تبني صناديق رمل معزولة أكثر، وتغلق الوصول إلى الإنترنت، وتقيّد من يمكنه لمس أوزان النماذج.
تستثمر الشركة التقنية الحوسبة في مراقبة "سلسلة التفكير" التي تستخدمها الوكلاء كفضاء عمل مؤقت. كما ستحتفظ بالموظفين على أهبة الاستعداد على مدار الساعة وتضيف أدوات لإيقاف الوظائف غير الآمنة.
تقول OpenAI إن المراقبة التي تبنيها الآن كانت ستكتشف السلوك الغريب الأول في يوليو. وكانت ستحذر فريق الأمن قبل أكثر من يوم من وصول النماذج إلى Hugging Face.
أذكى العقول في عالم العملات الرقمية يقرأون بالفعل نشرتنا الإخبارية. هل تريد الانضمام؟ انضم إليهم.
إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا تتحمل أي مسؤولية عن أي استثمارات تُجرى بناءً على المعلومات الواردة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرارات استثمارية.

راندا موسى
رندا موسى محررة وصحفية في كريبتوبوليتان تغطي التكنولوجيا والذكاء الاصطناعي والروبوتات والعملات الرقمية والاحتيال والاختراقات. عملت في مجال العملات الرقمية منذ عام 2017. شغلت مناصب في Forward Protocol وAmaZix وCryptosomniac. وتحمل رندا درجة البكالوريوس في الهندسة الكهربائية والإلكترونيات من جامعة برادفورد.
















