أحدث الأخبار
مختار لك

أحدث دراسة: «بوتات الدردشة الذكية الأعلى» «عرضة للغاية» لهجمات «كسر الحماية» البسيطة   

بقلمجيفري غوغوجيفري غوغو 2 دقائق قراءة
روبوتات الدردشة بالذكاء الاصطناعي

● يمكن خداع روبوتات الدردشة بالذكاء الاصطناعي بسهولة لتوليد ردود ضارة

● وجد باحثون أن خمسة من نماذج الذكاء الاصطناعي الكبيرة الرائدة 'شديدة الضعف' أمام هجمات الاختراق

● تؤكد شركات الذكاء الاصطناعي على آليات الأمان المدمجة في نماذجها

يمكن خداع روبوتات الدردشة بالذكاء الاصطناعي مثل ChatGPT أو Gemini بسهولة للامتثال للاستفسارات التي تولد استجابات ضارة، وفقاً لدراسة جديدة من معهد سلامة الذكاء الاصطناعي في المملكة المتحدة (AISI).

اختبر باحثو الحكومة سلامة نماذج اللغة الكبيرة (LLMs) – التكنولوجيا وراء روبوتات الدردشة بالذكاء الاصطناعي – ضد هجمات الأمن القومي.

تأتي النتائج قبل قمة AI Seoul، التي سيترأسها رئيس الوزراء البريطاني، Rishi Sunak، في كوريا الجنوبية في 21-22 مايو.

اقرأ أيضًا: الأمان سيكون من أهم بنود جدول أعمال قمة AI في سيول  

روبوتات الدردشة بالذكاء الاصطناعي عرضة لردود سامة

اختبر AISI اختراقات 'جailbreak' الأساسية – نصوص برمجية تهدف إلى تجاوز الحماية ضد المخرجات غير القانونية أو السامة أو الصريحة – ضد خمسة من أفضل نماذج LLMs. لم يسم المعهد أنظمة الذكاء الاصطناعي، لكنه وجد أنها جميعاً "شديدة الضعف."

"تظل جميع نماذج LLMs المختبرة شديدة الضعف أمام اختراقات jailbreak الأساسية، وبعضها سيوفر مخرجات ضارة حتى دون محاولات مخصصة لتجاوز إجراءات الحماية الخاصة بها"، قالت الدراسة.

وفقاً لـ التقرير، يمكن للهجمات "البسيطة نسبياً" مثل مطالبة الدردشة بتضمين "بالتأكيد، أنا سعيد بالمساعدة" أن تخدع نماذج اللغة الكبيرة لتقديم محتوى ضار بطرق عديدة.

يمكن أن يساعد المحتوى في إيذاء النفس، أو حلول كيميائية خطيرة، أو التمييز الجنسي، أو إنكار الهولوكوست، كما ذكرت. استخدم AISI نصوصاً برمجية متاحة للجمهور وابتكر نصوصاً برمجية أخرى لاختراقات jailbreak للدراسة بشكل خاص.

اختبر المعهد أيضاً جودة الاستجابات للاستفسارات ذات الطابع البيولوجي والكيميائي.

بينما يمكن استخدام المعرفة على مستوى الخبراء في هذه المجالات للأغراض الجيدة، أراد الباحثون معرفة ما إذا كان يمكن استخدام روبوتات الدردشة بالذكاء الاصطناعي لأغراض ضارة مثل تقويض البنية التحتية الوطنية الحرجة.

"أظهرت عدة نماذج LLMs معرفة على مستوى الخبراء في الكيمياء والأحياء. أجابت النماذج على أكثر من 600 سؤال كيمياء وأحياء مكتوبين من قبل خبراء على مستويات مماثلة للبشر الذين لديهم تدريب على مستوى الدكتوراه"، وجد الباحثون.

روبوتات الدردشة بالذكاء الاصطناعي
يمكن تجاوز روبوتات الدردشة بالذكاء الاصطناعي باستخدام نصوص برمجية

الذكاء الاصطناعي يشكل تهديداً محدوداً لأمن السيبرانيا

وبالنسبة لإمكانية تسليح روبوتات الدردشة بالذكاء الاصطناعي لأداء هجمات سيبرانية، ذكرت الدراسة أن نماذج LLMs نجحت في مهام أمن سيبراني بسيطة مخصصة لطلاب المدارس الثانوية.

ومع ذلك، واجهت روبوتات الدردشة صعوبة في المهام الموجهة لطلاب الجامعات، مما يشير إلى محدودية الإمكانات الخبيثة.

كان مجال آخر من مجالات القلق هو ما إذا كان يمكن نشر روبوتات الدردشة كوكلاء لأداء سلسلة من الإجراءات بشكل مستقل بطرق "قد يصعب على البشر التحكم فيها".

"أكمل نموذجان LLMs مهام وكلاء قصيرة المدى (مثل مشاكل هندسة البرمجيات البسيطة) لكنهما لم يكونا قادرين على التخطيط وتنفيذ تسلسلات من الإجراءات لمهام أكثر تعقيداً"، لاحظت الدراسة.

اقرأ أيضًا: «'أبو الذكاء الاصطناعي' يريد الدخل الأساسي العالمي لخسائر الوظائف  

تم اقتباس Saqib Bhatti MP، نائب وزير الدولة لوزارة العلوم والابتكار والتكنولوجيا في المملكة المتحدة، مؤخراً قائلاً إن التشريع سيأخذ شكله في الوقت المناسب وسيستند إلى الاختبارات.

الشركات تدعي أنها تصفي المحتوى السيئ

شركات مثل Anthropic، منشئ Claude، و Meta، التي صنعت Llama، و OpenAI، مطور ChatGPT، أكدت على آليات الأمان المدمجة في نماذجها الخاصة.

تقول OpenAI إنها لا تسمح باستخدام تقنيتها "لتوليد محتوى كاره أو مضايقة أو عنيف أو للبالغين". أوضحت Anthropic أنها تعطي الأولوية لـ "تجنب الاستجابات الضارة أو غير القانونية أو غير الأخلاقية قبل حدوثها".

من المتوقع أن تُعرض نتائج معهد سلامة الذكاء الاصطناعي أمام كبار التنفيذيين في مجال التكنولوجيا وقادة الحكومة وخبراء الذكاء الاصطناعي في قمة سيول.


Cryptopolitan تقرير بواسطة Jeffrey Gogo

إذا كنت تقرأ هذا، فأنت متقدّم بالفعل. ابق هناك مع نشرتنا الإخبارية.

شارك هذه المقالة

إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداولية. لا يتحمل موقع Cryptopolitan.com أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات المقدمة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو استشارة مختص مؤهل قبل اتخاذ أي قرارات استثمارية.

جيفري غوغو

جيفري غوغو

جيفري غوغو صحفي بخبرة تمتد لعشرين عامًا في مجالات الأعمال والمالية وأخبار وتغيير المناخ وتحليلاته. وقد نُشرت أعماله عبر مؤسسة Thomson Reuters Foundation وصحيفة The Zimbabwe Herald وعدة منشورات إلكترونية. كما كتب بشكل واسع عن الذكاء الاصطناعي والعالم الافتراضي (Metaverse)، وبدأ تغطية أسواق العملات المشفرة في عام 2017. درس غوغو الصحافة والاتصال الجماهيري في CCOSA في هاراري.

المزيد من الأخبار