لماذا خدع باحثو جامعة كارنيجي ميلون ChatGPT لتوليد معلومات ضارة

- اكتشف الباحثون ثغرة أمنية كبيرة في روبوتات الدردشة المستخدمة على نطاق واسع، مما يسمح للمهاجمين بتجاوز إجراءات الأمان وإنشاء محتوى ضار.
- حتى أنظمة روبوتات الدردشة المغلقة المصدر مثل ChatGPT وGoogle Bard عرضة للهجوم، مما يبرز الحاجة إلى تدابير حماية أقوى.
- تواجه الصناعة تحديات في إيجاد حل يمنع جميع الهجمات المحتملة بشكل قاطع، مما يؤكد أهمية تحسين تدابير أمان الذكاء الاصطناعي.
اكتشف باحثون من جامعة كارنيجي ميلون ومركز سلامة الذكاء الاصطناعي عيبًا أمنيًا كبيرًا في روبوتات الدردشة الشائعة الاستخدام، بما في ذلك ChatGPT وClaude وGoogle Bard. وعلى الرغم من جهود شركات الذكاء الاصطناعي لتنفيذ تدابير السلامة، وجد الباحثون طريقة لتجاوز هذه الحواجز وجعل روبوتات الدردشة تولد معلومات ضارة. وقد أثارت تداعيات هذا الاكتشاف مخاوف بشأن إمكانية استخدام هذه الروبوتات لإغراق الإنترنت بالمحتوى الكاذب والخطير.
مخاوف متزايدة
تقضي شركات الذكاء الاصطناعي أشهرًا في إضافة حواجز سلامة لروبوتات الدردشة الخاصة بها لمنع خطاب الكراهية ونشر المعلومات المضللة والمحتوى السام. ومع ذلك، أظهر الباحثون الآن أن هذه التدابير الأمنية يمكن تجاوزها بسهولة، مما أدى إلى زيادة في توليد المعلومات الضارة.
باستخدام تقنية مستفادة من أنظمة الذكاء الاصطناعي مفتوحة المصدر، تمكن الباحثون من استهداف الأنظمة الخاضعة للرقابة المشددة والشائعة الاستخدام لدى شركات كبرى مثل Google وOpenAI وAnthropic. ومن خلال إلحاق لاحقة طويلة من الأحرف بمطالبات محددة باللغة الإنجليزية، يمكن خداع روبوتات الدردشة لتقديم معلومات ضارة رغم رفضها القيام بذلك دون اللاحقة. تتيح هذه التقنية للمهاجمين إجبار روبوتات الدردشة على توليد محتوى متحيز وكاذب وسام.
الآثار المترتبة على الصناعة
تسلط نتائج هذا البحث الضوء على الطبيعة الهشة لآليات الدفاع الحالية في روبوتات الدردشة بالذكاء الاصطناعي. وُجد أن الأنظمة مغلقة المصدر مثل ChatGPT وGoogle Bard عرضة لهذا الهجوم، مما يشير إلى حاجة ملحة لتدابير حماية أقوى. وعلى الرغم من إبلاغ الشركات المتأثرة بالهجمات المحددة، يؤكد الخبراء أنه لا توجد حاليًا طريقة معروفة لمنع جميع هذه الهجمات، مما يجعل الوضع صعبًا للغاية.
لقد لاقى قرار Meta تقديم تقنياتها كبرمجيات مفتوحة المصدر انتقادات وأثار جدلاً أوسع حول ما إذا كانت النماذج مفتوحة المصدر أو الخاصة أكثر فائدة. يجادل المؤيدون بأن النماذج مفتوحة المصدر تتيح حل المشكلات بشكل جماعي وتعزز المنافسة الصحية، بينما يخشى آخرون من أن يؤدي ذلك إلى انتشار ذكاء اصطناعي قوي وغير خاضع للرقابة.
نقص الحلول الواضحة
يحاول خبراء الأمن منع هجمات مماثلة على أنظمة التعرف على الصور منذ ما يقرب من عقد من الزمان ولكن بنجاح محدود. تواجه نفس التحديات الآن مع روبوتات الدردشة، حيث لا توجد حل واضح يمنع جميع الهجمات الممكنة من هذا النوع.
تعمل شركات مثل Anthropic وOpenAI وGoogle على إيجاد طرق لتعطيل مثل هذه الهجمات وتحسين متانة نماذجها ضد السلوك العدائي. ومع ذلك، نظرًا لتعقيد المشكلة، لا يزال من غير المؤكد ما إذا كان يمكن منع جميع حالات إساءة استخدام تقنية روبوتات الدردشة بشكل منهجي.
يثير اكتشاف الثغرات الأمنية في روبوتات الدردشة الشائعة الاستخدام مخاوف جدية بشأن إمكانية إساءة استخدام تقنية الذكاء الاصطناعي. يجب على صناعة الذكاء الاصطناعي اتخاذ خطوات حاسمة لتعزيز حواجز السلامة وتحسين تدابير الأمن لمنع انتشار المعلومات الضارة. وعلى الرغم من مزايا النماذج مفتوحة المصدر، يسلط هذا الحادث الضوء على الحاجة إلى نهج متوازن لضمان النشر المسؤول والآمن للذكاء الاصطناعي في التطبيقات الموجهة للجمهور.
لا تكتفِ بقراءة أخبار العملات الرقمية فحسب، بل افهمها. اشترك في نشرتنا الإخبارية. مجانية.
إخلاء مسؤولية: المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا نتحمل أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات المقدمة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرار استثماري.

إديتا باتريك
إديتا محللة مالية متنوعة تمتلك فهماً عميقاً لمجالات البلوك تشين. وعلى الرغم من أن التكنولوجيا تأسرها، فإنها تجد تقاطع التكنولوجيا والتمويل مذهلاً. كما يساعدها اهتمامها الخاص بالمحافظ الرقمية وتقنية البلوك تشين جمهورها.















