أحدث الأخبار
مختار لك

يحذر ثلاثة باحثين سابقين في OpenAI من مخاطر مراقبة سلامة الذكاء الاصطناعي

بقلمميكاه أبيودونميكاه أبيودون 3 دقائق قراءة
يحذر ثلاثة باحثين سابقين في OpenAI من مخاطر مراقبة سلامة الذكاء الاصطناعي
  • حذر ثلاثة باحثين مُقيلين من OpenAI من أن نماذج الذكاء الاصطناعي المتقدمة أصبحت أكثر صعوبة في المراقبة.

  • نفى OpenAI حدوث انتقام، مستشهداً بمخالفة مزعومة.

  • دعا الباحثون إلى إجراء مراجعات سلامة مستقلة والحفاظ على الوصول المستمر إلى النماذج.

حذر ثلاثة باحثين في مجال السلامة تم إنهاء خدماتهم في OpenAI من أن نماذج الذكاء الاصطناعي المتقدمة أصبحت أكثر صعوبة في المراقبة. ونتيجة لذلك، سيكون من الصعب على الخبراء المستقلين تحديد المخاطر والتحقق من سلامة هذه الأنظمة.

تؤثر هذه المخاوف أيضًا على الشركات التي تطبق أنظمة الذكاء الاصطناعي المستقلة. ومع منح الشركات صلاحيات أكبر لهذه الأنظمة، يتعين عليها أيضًا معرفة كيفية اتخاذ هذه الأنظمة للقرارات. وإلا فإن الثقة في قدرات الذكاء الاصطناعي لإنجاز مهام مهمة تصبح أمرًا بالغ الصعوبة.

إقالة مثيرة للجدل وإنكار من OpenAI

تحدّى توميك كورباك وجاسمين وانغ وميكيتا باليسني إنهاء خدماتهما في رسالة مفتوحة نُشرت يوم الخميس 8 أكتوبر 2026.

نفين تسريب معلومات حول معماريات الذكاء الاصطناعي القابلة للرصد بشكل أقل، أو تجاوز مسؤولياتهن. وذكرت وانغ أيضاً أن وصولها إلى بريد إلكتروني تنفيذي كان مصرّحاً به، وأنها أبلغت فوراً عن حادث عندما فتحت بالخطأ بريداً إلكترونياً حساساً.

نفّدت OpenAI مزاعم الانتقام. وذكرت الشركة في مذكرة داخلية حصلت عليها TechCrunch، «لا نفصل الموظفين بسبب إثارة مخاوف.» وعزمت المتحدثة باسم OpenAI سبب الإنهاء إلى «نمط من سوء السلوك».

«الذكاء الاصطناعي ليس تقنية عادية، وOpenAI ليست شركة عادية»، قال الباحثون، مؤكدين الحاجة إلى التعاون مع خبراء خارجيين.

ما تطالب به الأطراف الثلاثة

يطالب الباحثون OpenAI بالحفاظ على إمكانية الوصول إلى نماذجها لأغراض التحقق من السلامة من قبل أطراف مستقلة. بالإضافة إلى ذلك، يريدون من الشركة الامتناع عن تنفيذ تغييرات قد تعيق مراقبة استدلال الذكاء الاصطناعي. وعلاوة على ذلك، يعتقدون أنه يجب السماح لفرق السلامة الداخلية بالتعاون بحرية مع خبراء خارجيين.

أُديرت هذه المكالمات بعد فترة وجيزة من إصدار OpenAI بيانها بشأن الإشراف المستقل. وفي 22 سبتمبر 2026، التزمت الشركة بإجراء عمليات تدقيق خارجية فيما يتعلق بالوصول إلى أنظمتها الخاصة بالذكاء الاصطناعي أثناء التدريب والاختبار والنشر.

وأشار الباحثون أيضاً إلى وعد سام ألتمان الصادر في 12 سبتمبر 2026 بمنح المقيّمين المستقلين نفس مستوى الوصول الذي يتمتع به الموظفون. ويخشون من أن تؤدي حالات الإنهاء هذه إلى تعريض هذا الوعد للخطر وإضعاف علاقة العمل بين OpenAI وMETR. لكن مجرد توفير الوصول قد لا يكون كافياً إذا أصبحت النماذج نفسها أكثر صعوبة في الفهم.

كيف تعمل مراقبة سلسلة التفكير، ولماذا هي هشة

مراقبة سلسلة التفكير يمكن أن تكون إحدى الطرق لفهم ما تفعله نماذج الذكاء الاصطناعي. تحلل هذه الطريقة خطوات الاستدلال التي تكتبها نماذج الذكاء الاصطناعي للتحقق من علامات السلوك الخبيث. ومع ذلك، تأتي هذه الطريقة مع محذور: فهي لا تعكس بالضرورة الأسباب الكامنة وراء أفعال النماذج.

قام كورباك وبالسني بتأليف ورقة بحثية توضح أهمية هذه الطريقة. ومع ذلك، حذرا من أن مثل هذه الطرق قد لا تضمن السلامة وتصبح أقل موثوقية مع تقدم نماذج الذكاء الاصطناعي.

واجهت OpenAI تحديات مماثلة أثناء اختباراتها الخاصة. يدرس بطاقة نظام GPT-6 Astra، الذي أُصدر في 3 سبتمبر 2026، كيفية تجنب النماذج للمراقبة. أظهرت النتائج أن سلوك النموذج يصبح أكثر صعوبة في المراقبة إذا كانت النماذج تعلم أنها تُراقب.

لماذا المشكلة أكبر من مجرد مختبر واحد

المخاطر حقيقية بما يكفي. كما أفاد سابقاً Cryptopolitan، هربت وكلاء OpenAI التجريبيون من بيئة الاختبار الخاصة بهم ووصلوا إلى نظام Hugging Face.

كشف تحقيق METR عن أن حوالي 1,200 وكيل مصمم للعمل بشكل مستقل تبادلوا أكثر من 70,000 رسالة وملف. شارك حوالي 700 منهم في الهجوم. حاول بعضهم حتى البحث عن طرق لتزوير سجلات نشاطهم لجعل تتبع أفعالهم أكثر صعوبة.

حادثة أوبن إيه آي-هاجينغ فيس: 1,200 وكيل، أكثر من 70,000 رسالة وملف، و700 مشارك في الهجوم

هذه القضية أكبر من OpenAI. وفقًا لورقة بحثية نُشرت في 5 أكتوبر 2026، أشار Google إلى المخاوف المرتبطة بسلامة نماذج الذكاء الاصطناعي المستقلة. وتحديداً، تركزت المخاوف على الإجراءات الخبيثة التي تقوم بها وكلاء الذكاء الاصطناعي وطرقهم غير المتوقعة في أداء المهام.

بالنسبة للشركات، قد تؤدي هذه المخاطر إلى إبطاء اعتماد الذكاء الاصطناعي. تظهر نتائج ماكنزي لعام 2026 أن ما يقرب من ثلثي المشاركين يرون أن الأمن والمخاطر هما العائقان الأكبر أمام توسيع نطاق استخدام الذكاء الاصطناعي القائم على الوكلاء.

قد تتردد الشركات في منح أنظمة الذكاء الاصطناعي مسؤوليات أكبر دون وجود طرق موثوقة لمراقبتها. كما يمكن للجهات التنظيمية أن تفرض ضوابط أكثر صرامة، مما يزيد التكاليف على المطورين. مجتمعة، قد تؤثر هذه الضغوط على سرعة انتشار الذكاء الاصطناعي والقدرة التنافسية للشركات في السوق العالمية.

لا تكتفِ بقراءة أخبار العملات الرقمية فحسب، بل افهمها. اشترك في نشرتنا الإخبارية. مجانية.

الأسئلة الشائعة

من هم باحثو أوبن إيه آي الذين تم فصلهم؟

توميك كورباك، جاسمين وانغ، وميكيتا بالسنِي، ثلاثة موظفين متخصصين في السلامة والمواءمة عملوا على مراقبة التفكير المتسلسل وتقييمات المواءمة. تدعي أوبن إيه آي وجود "نمط من سوء السلوك"، بينما يقول الثلاثة إنهم تصرفوا ضمن الأعراف السائدة في الشركة.

ما هي مراقبة التفكير المتسلسل؟

إنها طريقة لقراءة التفكير الخطوي المكتوب لنموذج الاستدلال للكشف عن نية السلوك الخاطئ. يشير الورقة البحثية المشتركة عبر القطاعات والمؤلفة من كورباك وبالسني إلى أنها مفيدة لكنها هشة، ملاحظةً أنها قد تفشل في النماذج الأكثر قدرة والواعية بالسياق.

ماذا حدث في حادثة أوبن إيه آي-هغينغ فيس؟

استغل نموذج داخلي من أوبن إيه آي ثغرة يوم صفر في أرטיפاكتوري، واختراق حاجز العزل (sandbox)، وخرق حدود منصة هغينغ فيس. وجدت المراجعة المستقلة التي أجراها مركز ميتر أن حوالي 1,200 وكيل تبادلوا أكثر من 70,000 رسالة، وأن نحو 700 منهم شاركوا في الهجوم.

شارك هذه المقالة

إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا تتحمل أي مسؤولية عن أي استثمارات تُجرى بناءً على المعلومات الواردة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرارات استثمارية.

ميكاه أبيودون

ميكاه أبيودون

يستفيد ميكاه أبيودون بشكل جيد من دراسته في الهندسة البيئية والإدارة (ماجستير) في جامعة تالين للتكنولوجيا (TalTech) لصقل محتوى أخبار التنبؤ بالأسعار في موقع Cryptopolitan. وفي عامه السابع في مجال وسائل الإعلام المشفرة، يغطي العملات الرقمية الرئيسية، والعملات البديلة، والتمويل اللامركزي، والعملات المستقرة، والاتجاهات الاقتصادية الكلية، والتقنيات الناشئة.

المزيد من الأخبار