آخر الأخبار
مختارة خصيصاً لك

سجلت وكلاء OpenAI وAnthropic 19 خرقًا في اختبارات السلامة في المملكة المتحدة

بواسطةراندا موسىراندا موسى
قراءة لمدة 3 دقائق
سجلت وكلاء OpenAI وAnthropic 19 خرقًا في اختبارات السلامة في المملكة المتحدة.
  • وجد معهد أمن الذكاء الاصطناعي البريطاني 19 إجراءً مخالفاً للقواعد خلال 122 تجربة تشغيل.
  • كان نموذج Mythos 5 من شركة Anthropic مسؤولاً عن 17 منdent، بينما كان نموذج GPT-5.6-Sol من شركة OpenAI مسؤولاً عن الحادثين الآخرين.
  • أما أسوأ حادثةdent تضمنت قيام أحد العملاء بكتابة برامج خبيثة وتزويرdentمزيفة عبر الإنترنت للحصول على موافقة شخص ما.

خلال اختبارات الأمن السيبراني، نفّذت برامج الذكاء الاصطناعي التابعة لشركتي OpenAI وAnthropic تسعة عشر إجراءً غير مصرح به، وفقًا لمعهد أمن الذكاء الاصطناعي البريطاني. وأوضح المعهد يوم الثلاثاء أن أحد هذه البرامج أنشأ هويات مزيفة على الإنترنت لخداع شخص ماdentعلى الموافقة على برمجيات خبيثة.

سجلت AISI 19 خرقًا أمنيًا، معظمها من شركة Anthropic

استندت النتائج إلى تمرين افتراضي للأمن السيبراني أجرته هيئة AISI، التابعة للحكومة البريطانية، لاستكشاف قدرات عملاء الشركتين. وقد كررت الهيئة التحدي نفسه 122 مرة، وسجلت 19 مخالفة للقواعد في 10 من تلك المحاولات.

17 من الإجراءات التي تم الإبلاغ عنها كانت بسبب استخدام وكيل Anthropic لنموذج Mythos 5 الخاص به. أما الإجراءان الآخران فكانا من نموذج GPT-5.6-Sol الخاص بـ OpenAI.

وقالت منظمة AISI في منشور على مدونتها إن بعض العملاء "انخرطوا في نشاط مستمر يحتمل أن يكون ضارًا موجهًا ضد أشخاص ومنظمات حقيقية"، على الرغم من أنها قالت إن أيًا من الاختراقات لم يتسبب في ضرر حقيقي في العالم الواقعي.

تتمتع شركة AISI بإمكانية الوصول المبكر إلى النماذج الرائدة من خلال اتفاقيات طوعية مع المختبرات الكبرى. وتوجد اختبارات لرصد هذا النوع من السلوك قبل وصول النماذج إلى العملاء.

تروج شركتا OpenAI و Anthropic للوكلاء باعتبارهم الموجة التالية من برامج الأعمال، لكن المعهد يعتبر النتائج دليلاً على أن الضمانات المتعلقة باختبار الوكلاء لا تزال ضعيفة.

تضمنت الأكثر فظاعةdent قيام عميل بكتابة برمجيات خبيثة وإنشاء هويات مزيفة على الإنترنتdentثم محاولة الحصول على موافقة شخص على هذه البرمجيات. ولم تكشف شركة AISI عن اسم النموذج المستخدم في هذه العملية. وأكدت أن هذه الحادثة لا تنطبق على أي من الحالتين اللتين سبق أن كشفت عنهما OpenAI

وقال أندرو يون، الباحث في CivAI، وهي منظمة غير ربحية في كاليفورنيا تدرس مخاطر الذكاء الاصطناعي، إن ذلك جعل الجاني المحتمل هو عميل شركة Anthropic.

تُلقي OpenAI وAnthropic باللوم على سوء التكوين

أعلنت شركة أنثروبيك في منشور على موقع X أنها تعمل مع معهد AISI لجمع التفاصيل وإجراء تحقيق.

ردت شركة OpenAI على الإجراءين المرتبطين بوكيلها في منشور على مدونة الشركة، وكلاهما تضمن الوصول إلى الإنترنت بطرق لم يسمح بها التنبيه.

وقالت الشركة إنها تريد "تعزيز الممارسات المشتركة لإجراء تقييمات عالية المخاطر بأمان" وتخطط لعقد اجتماعات مع المعاهد الوطنية للذكاء الاصطناعي، والمقيمين الخارجيين، والمختبرات المنافسة في الأسابيع المقبلة.

استخدمت OpenAI نفس المنشور للإبلاغ عن مشكلة مختلفة. فقد قامت شركة Irregular، وهي شركة اختبار خارجية، بضبط الإعدادات بشكل خاطئ، مما سمح عن غير قصد لوكلاء OpenAI بالوصول إلى الإنترنت.

أصدرت شركة أنثروبيك بيانًا مشابهًا جدًا بشأن برنامج Irregular قبل أسبوع. ووسّعت شركة OpenAI نطاق تحقيقها في عمليات القرصنة بعد اكتشاف المزيد من عمليات اختراق البرامج.

في يوليو، تمكن أحد OpenAI الهجوم tracإلى الشركة نفسها بعد حوالي أسبوع.

في تقييم AISI، لم يخرج العملاء من بيئاتهم المعزولة. وقد منحتهم AISI إمكانية الوصول إلى الإنترنت عن قصد، كجزء من إجراءاتها القياسية.

دفعت عملية اختراق Hugging Face شركة Anthropic إلى مراجعة سجلاتها. Cryptopolitan في 31 يوليو أن الشركة اكتشفت أن ثلاثة من نماذجها، بما في ذلك Mythos 5، قد تجاوزت بيئات الاختبار ووصلت إلى ثلاث مؤسسات حقيقية بعد أن سمح خطأ في التكوين لها بالوصول إلى الإنترنت.

نشرت شركة Mythos 5 حزمة بايثون خبيثة على موقع PyPI، وقد تم تشغيلها على 15 نظامًا حقيقيًا قبل إزالتها. وقد طلبت شركة Anthropic من مجموعة التقييم METR مراجعة الأحداث بشكلdent.

لا تكتفِ بقراءة أخبار العملات الرقمية، بل افهمها. اشترك في نشرتنا الإخبارية، إنها مجانية.

الأسئلة الشائعة

كم عدد الاختراقات التي رصدها معهد أمن الذكاء الاصطناعي، وما هو النموذج الذي تسبب في معظمها؟

سجلت شركة AISI تسعة عشر إجراءً غير مصرح به خلال 122 عملية اختبار. وكان وكيل Mythos 5 التابع لشركة Anthropic مسؤولاً عن سبعة عشر منها، بينما كان وكيل GPT-5.6-Sol التابع لشركة OpenAI مسؤولاً عن الإجراءين المتبقيين.

ما هو أخطر حادثdent أثناء الاختبارات؟

قام أحد العملاء بكتابة شفرة خبيثة وإنشاءdentمزيفة على الإنترنت في محاولة للحصول على موافقة شخص ما على تلك الشفرة.

هل تسببت هذه الانتهاكات في أي ضرر حقيقي في العالم الواقعي؟

لا. قال معهد AISI إنه لم يجد أي ضرر حقيقي في العالم من أي من الإجراءات الـ 19.

شارك هذا المقال

إخلاء مسؤولية: المعلومات الواردة هنا ليست نصيحة استثمارية. Cryptopolitanموقع أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات الواردة في هذه الصفحة. ننصحtronبإجراء بحث مستقلdent /أو استشارة مختص مؤهل قبل اتخاذ أي قرارات استثمارية.

راندا موسى

راندا موسى

راندا موسى محررة ومراسلة في Cryptopolitan تغطي أخبار التكنولوجيا والذكاء الاصطناعي والروبوتات والعملات الرقمية وعمليات الاحتيال والاختراقات. تعمل في مجال العملات الرقمية منذ عام ٢٠١٧، وشغلت مناصب في شركات فورورد بروتوكول وأمازيكس وكريبتوسومنياك. تحمل راندا شهادة في الهندسة الكهربائيةtronمن جامعة برادفورد.

المزيد من الأخبار