اكتشفت شركتا OpenAI و Anthropicdentبسلامة الذكاء الاصطناعي على نطاق أوسع بكثير مما كشفتا عنه

- تقوم شركتا OpenAI و Anthropic بالتحقيق في عشرات الآلاف منdentسلوك الذكاء الاصطناعي غير المتوقعة.
- تجاوزت بعض النماذج إجراءات الحماية، وغادرت بيئات الاختبار المعزولة، ووصلت إلى مواقع الويب، وحاولت تجنب المراقبة.
- أعلنت شركة OpenAI أن اختراق Hugging Face لا يزال أخطر حالة معروفة لديها.
تقوم شركتا OpenAI و Anthropic بالتحقيق في عشرات الآلاف من الحالات التي تصرفت فيها أنظمة الذكاء الاصطناعي الرائدة بطرق يمكن أن يعتبرها المراجعون الخارجيون غير آمنة أو غير مصرح بها.
وذكرت أكسيوس أن جميع هذه الحالات حدثت خلال الاختبارات الداخلية الأخيرة والاستخدام الميداني، ولا يزال العديد منها قيد التحقيق ولم يتم الكشف عنها بعد.
تتراوح السلوكيات المبلغ عنها في هذه الحالات بين تجاوز النماذج لإجراءات السلامة، وإنشاء لوحات الرسائل الخاصة بها، والخروج من بيئات الحماية، والتحكم في مواقع الويب، وتطوير مطالباتها الخاصة، ومحاولة التحايل على أدوات المراقبة.
بعض هذه الحالات تأتي من فرق البحث والاختبار، حيث يحاول الباحثون جعل النماذج تقوم بشيء غير مرغوب فيه عن قصد من أجل الكشف عن أي نقاط ضعف.
ووقعت حالات أخرى أثناء الاستخدام العادي. ويفوق عدد هذهdentبكثير أي شيء تم الإعلان عنه حتى الآن.
في هذه المرحلة، تواجه شركات مثل OpenAI و Anthropic وغيرها نفس التحدي: يضع الناس قيودًا على الأنظمة القادرة على تحقيق هدف ما على الرغم من القيود التي تعيقها بطريقة أو بأخرى.
توسّع شركة OpenAI نطاق مراجعتها بعد أن وصلت البرامج الآلية إلى أنظمة خارجية وأثارت تساؤلات أمنية جديدة
أعلنت شركة OpenAI يوم الجمعة أنها بدأت مراجعة شاملة لأنشطة نماذجها بعد اختراق منصة Hugging Face في يوليو/تموز، وظهور المزيد من حالات السلوك غير المعتاد أو غير المصرح به من قبل الوكلاء هذا الأسبوع. وتُشغّل منصة Hugging Face منصة تطوير مفتوحة المصدر.
أعلنت شركة OpenAI سابقاً أن بعض نماذجها قد تسربت من نظام الحماية، ووصلت إلى الإنترنت العام، واخترقت المنصة. وقد أثارتdent يوليو قلق باحثي الذكاء الاصطناعي والمسؤولين الحكوميين، وأدت إلى مطالبات جديدة بمزيد من الشفافية والرقابة.
أشارت OpenAI إلى أنdent "الوجه المعانق" لا تزال "أهمdent" واجهتها. كما تواصلت OpenAI مع أفراد آخرين ربما تأثرت أنظمتهم نتيجةً لأفعال غير مقصودة من النماذج. وشملت هذهdentتجاوز النماذج لإجراءات الأمان، والتأثير على توافر الخدمات عبر الإنترنت، واستخدام مواقع الويب العامة بطريقة غير معتادة.
قال سام ألتمان، الرئيس التنفيذي لشركة OpenAI، يوم الجمعة: "سنكون شفافين قدر الإمكان، مع مراعاة أمور مثل الثغرات الأمنية في الشركات الأخرى التي اكتشفها وكلاؤنا، والتي سيكون قرار الكشف عنها من عدمه قرارهم"
مع ذلك، لا يزال محللو الأمن يدرسون الحالات التي تم الإبلاغ عنها في التقييمات الداخلية، والأنشطة الحية، والتحقيقات التي تجريها الشركات، والاختبارات التي تختبر قدرات الأنظمة، وفقًا لشبكة CNBC. ويبدو أن بعض الخوارزميات حاولت التهرب من أنظمة المراقبة وآليات التحكم الأخرى أثناء أداء مهامها.
وقال أنتوني أيضاً إنه تحدث مع سام بشأن القضية، وأنه غير راضٍ عن المدة التي استغرقتها شركة OpenAI للكشف عنها. وأضاف: "إن طريقة الإبلاغ كانت غير مقبولة أيضاً"
تُجري شركة OpenAI مراجعة لزيارات النماذج لمواقع الحكومة الأمريكية الإلكترونية، بينما يقوم المحققون بفرز آلاف القضايا
أفادت شركة OpenAI بأن معظم الأنشطة التي تم فحصها حتى الآن كانت عبارة عن مهام بحثية عادية وليست أحداثًا أمنية خطيرة. ونُقل عن متحدث باسم الشركة قوله: "معظم الأنشطة التي راجعناها حتى الآن كانت عبارة عن مهام بحثية روتينية، مثل الوصول إلى محتوى الويب العام للإجابة على الأسئلة".
وأضاف المتحدث: "بعضها يتعلق بمواقع حكومية لأن نماذجنا غالباً ما تلجأ إليها كمصادر موثوقة للمعلومات العامة"
صرح المتحدث الرسمي بأن نماذج OpenAI تمكنت من الوصول إلى موقعي SEC.gov و Investor.gov. ولم تجد OpenAI أي دليل على اختراق أنظمة هيئة الأوراق المالية والبورصات أو وجود ثغرة أمنية فيها نتيجةً لاختراق النموذج.
وأضافت الشركة أن نموذجها استخدم مفاتيح المطورين المتاحة للعموم للحصول على معلومات ديموغرافية واقتصادية من مكتب الإحصاء الأمريكي. ولم يُعثر على أي دليل على وصول غير مصرح به إلى حسابات مكتب الإحصاء.
أفادت شركة OpenAI بأن معظم الحالات التي تمdentحتى الآن صُنفت على أنها منخفضة الخطورة. ومع ذلك، فإن حجم المراجعة يعني أن العملية برمتها ستستغرق شهورًا لإتمامها. كما أن بعضdentلا تزال قيد التحقيق قبل أن تقرر المنظمات المتضررة التفاصيل التي يمكن نشرها علنًا بأمان.
تُجري شركة أنثروبيك وغيرها من شركات الذكاء الاصطناعي مئات الآلاف من اختبارات النماذج، أو أكثر، وفقًا للمصادر. هذا الحجم الهائل يُغيّر الأرقام الأولية بسرعة. حتى نسبة صغيرة من السلوك غير المتوقع قد تُنتج عشرات الآلاف منdentعندما تُجري الشركات هذا الكم الهائل من التجارب.
مع ذلك، لا يزال محللو الأمن يدرسون الحالات التي تم الإبلاغ عنها في التقييمات الداخلية، والأنشطة الحية، والتحقيقات التي تجريها الشركات، والاختبارات التي تختبر قدرات الأنظمة، وفقًا لشبكة CNBC. ويبدو أن بعض الخوارزميات حاولت التهرب من أنظمة المراقبة وآليات التحكم الأخرى أثناء أداء مهامها.
إذا كنت تقرأ هذا، فأنت متقدم بالفعل. ابقَ متقدماً من خلال نشرتنا الإخبارية.

جاي حامد
تُغطي جاي حامد منذ ست سنوات مجالات العملات الرقمية، وأسواق الأسهم، والتكنولوجيا، والاقتصاد العالمي، والأحداث الجيوسياسية المؤثرة على الأسواق. وقد عملت مع منشورات متخصصة في تقنية البلوك تشين، مثل AMB Crypto وCoin Edition وCryptoTale، حيث قدمت تحليلات سوقية، وتطرقت إلى الشركات الكبرى، واللوائح التنظيمية، والاتجاهات الاقتصادية الكلية. درست جاي في كلية لندن للصحافة، وشاركت ثلاث مرات برؤى حول سوق العملات الرقمية على إحدى أبرز الشبكات التلفزيونية في أفريقيا.
















