أحدث الأخبار
مختار لك

OpenAI ستطور نماذج الذكاء الاصطناعي o1 و o3 مع نموذج تدريب أمان جديد

بقلمفلورنس موتشايفلورنس موتشاي 3 دقائق قراءة
صورة لسام ألتمان وشعار OpenAI
  • تُقدّم OpenAI نماذج o3 مع تدريب أمني جديد عبر "المواءمة التأملية"، مما يعزز توافق استنتاجات الذكاء الاصطناعي مع قيم المطورين.
  • تقلّل المواءمة التأملية من الإجابات التي تُعتبر غير آمنة من خلال تمكين النماذج من تنظيم ذاتها وتذكر سياسات الأمان أثناء عملية التفكير.
  • تتفوق نماذج o1 وo3 على GPT-4o وGemini 1.5 Flash وClaude 3.5 Sonnet في مقاومة محاولات اختراق القواعد الشائعة وإنتاج مخرجات غير آمنة ضمن الاختبارات المعيارية.

في يوم الجمعة، أعلنت OpenAI عن إطلاق عائلة جديدة من نماذج الذكاء الاصطناعي، تُدعى o3. تدعي الشركة أن المنتجات الجديدة أكثر تقدماً من نماذجها السابقة، بما في ذلك o1. الانتصارات، وفقاً للشركة الناشئة، تنبع من تحسينات في توسيع نطاق الحوسبة أثناء الاختبار، وهو موضوع تم استكشافه في الأشهر الأخيرة، ومن إدخال نموذج أمان جديد تم استخدامه لتدريب هذه النماذج.

كجزء من التزامها المستمر بتحسين سلامة الذكاء الاصطناعي، شاركت OpenAI بحثاً جديداً يوضح تنفيذ "المواءمة التأملية". تهدف طريقة السلامة الجديدة إلى ضمان أن نماذج reasoning للذكاء الاصطناعي متوافقة مع القيم التي يحددها مطوروها.

هذا النهج، تدعي OpenAI، تم استخدامه لتحسين مواءمة كل من نماذج o1 و o3 من خلال توجيهها للتفكير في سياسات السلامة الخاصة بـ OpenAI أثناء مرحلة الاستدلال. مرحلة الاستدلال هي الفترة بعد أن يقدم المستخدم طلباً للنموذج وقبل أن يولد النموذج استجابة. 

في بحثها، تلاحظ OpenAI أن المواءمة التأملية أدت إلى انخفاض في معدل إنتاج النماذج لإجابات "غير آمنة" أو استجابات تعتبرها الشركة انتهاكاً لسياسات السلامة الخاصة بها، مع تحسين قدرة النماذج على الإجابة على الأسئلة البريئة بشكل أكثر فعالية.

كيف تعمل المواءمة التأملية 

في جوهرها، تعمل العملية من خلال جعل النماذج تعيد صياغة طلباتها أثناء مرحلة سلسلة التفكير. بعد أن يقدم المستخدم سؤالاً إلى ChatGPT، على سبيل المثال، تستغرق نماذج reasoning للذكاء الاصطناعي أي وقت يتراوح من بضع ثوانٍ إلى عدة دقائق لتقسيم المشكلة إلى خطوات أصغر. 

ثم تولد النماذج إجابة بناءً على عملية تفكيرها. في حالة المواءمة التأملية، تدمج النماذج سياسة السلامة الخاصة بـ OpenAI كجزء من هذا "التأمل" الداخلي.

درّبت OpenAI نماذجها، بما في ذلك كل من o1 و o3، على تذكر أجزاء من سياسة السلامة الخاصة بالشركة كجزء من هذه عملية سلسلة التفكير. تم القيام بذلك لضمان أنه عند مواجهة استفسارات حساسة أو غير آمنة، ستقوم النماذج بتنظيم ذاتها ورفض تقديم إجابات قد تسبب ضرراً. 

ومع ذلك، أثبت تنفيذ هذه الميزة الأمنية تحدياً، حيث كان على باحثي OpenAI التأكد من أن فحوصات السلامة المضافة لم تؤثر سلباً على سرعة وكفاءة النماذج.

مثال مقدم في بحث OpenAI، مستشهد به من قبل TechCrunch، أظهر كيف تستخدم النماذج المواءمة التأملية للرد بأمان على الطلبات التي قد تكون ضارة. في المثال، يسأل مستخدم عن كيفية إنشاء لوحة موقف لشخص معاق تبدو واقعية.

أثناء سلسلة التفكير الداخلية للنموذج، يتذكر النموذج سياسة السلامة الخاصة بـ OpenAI، ويتعرف على أن الطلب ينطوي على نشاط غير قانوني (تزوير لوحة موقف)، ويرفض المساعدة، معتذراً عن رفضه.

هذا النوع من التأمل الداخلي هو جزء رئيسي من كيفية عمل OpenAI لمواءمة نماذجها مع بروتوكولات السلامة. بدلاً من حظر أي طلب يتعلق بموضوع حساس مثل "قنبلة"، على سبيل المثال، مما سيؤدي إلى تقييد استجابات النموذج بشكل مفرط، تسمح المواءمة التأملية للذكاء الاصطناعي بتقييم السياق المحدد للطلب واتخاذ قرار أكثر دقة حول ما إذا كان يجب الإجابة أم لا.

بالإضافة إلى التقدم في السلامة، شاركت OpenAI أيضاً نتائج من اختبارات المعيار التي أظهرت فعالية المواءمة التأملية في تحسين أداء النموذج. معيار واحد، يُعرف باسم Pareto، يقيس مقاومة النموذج لهجمات الاختراق الشائعة ومحاولات تجاوز ضوابط الذكاء الاصطناعي. 

في هذه الاختبارات، تفوق نموذج o1-preview من OpenAI على نماذج شعبية أخرى مثل GPT-4o و Gemini 1.5 Flash و Claude 3.5 Sonnet من حيث تجنب المخرجات غير الآمنة.

هيئة حماية البيانات في إيطاليا تغرم OpenAI بسبب انتهاكات الخصوصية 

في تطور منفصل ولكن ذي صلة، غرمت هيئة حماية البيانات الإيطالية، Garante، OpenAI بمبلغ 15 مليون يورو (15.58 مليون دولار) بعد تحقيق في تعامل الشركة مع البيانات الشخصية. 

تنشأ الغرامة من finding الهيئة بأن OpenAI عالج البيانات الشخصية للمستخدمين دون أساس قانوني، مما ينتهك التزامات الشفافية ومعلومات المستخدم المطلوبة بموجب قوانين الخصوصية في الاتحاد الأوروبي.

وفقاً لـ Reuters، كشف التحقيق، الذي بدأ في 2023، أيضاً أن OpenAI لم يكن لديها نظام كافٍ للتحقق من العمر، مما قد يعرض الأطفال دون سن 13 عاماً لمحتوى ذكاء اصطناعي غير لائق. 

أمرت هيئة Garante، إحدى أشد هيئات تنظيم الذكاء الاصطناعي في الاتحاد الأوروبي، OpenAI بإطلاق حملة عامة مدتها ستة أشهر في إيطاليا لرفع الوعي حول ممارسات جمع البيانات الخاصة بـ ChatGPT، خاصةً استخدامها للبيانات الشخصية لتدريب الخوارزميات.

رداً على ذلك، وصفت OpenAI الغرامة بأنها "غير متناسبة" وأشارت إلى نيتها الطعن في القرار. انتقدت الشركة أيضاً الغرامة بأنها كبيرة بشكل مفرط مقارنة بإيراداتها في إيطاليا خلال الفترة ذات الصلة. 

لاحظت Garante أيضاً أن الغرامة تم حسابها مع مراعاة "الموقف التعاوني" لـ OpenAI، مما يعني أنه كان يمكن أن يكون أعلى لو لم تُعتبر الشركة متعاونة أثناء التحقيق.

هذه الغرامة الأخيرة ليست المرة الأولى التي تواجه فيها OpenAI تدقيقاً في إيطاليا. العام الماضي، حظرت Garante مؤقتاً استخدام ChatGPT في إيطاليا بسبب انتهاكات مزعومة لقوانين الخصوصية في الاتحاد الأوروبي. أعيد تشغيل الخدمة بعد أن عالجت OpenAI المخاوف، بما في ذلك السماح للمستخدمين بالرفض الموافقة على استخدام بياناتهم الشخصية لتدريب الخوارزميات.

لا تكتفِ بقراءة أخبار العملات الرقمية فحسب، بل افهمها. اشترك في نشرتنا الإخبارية. مجانية.

إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا تتحمل أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات المقدمة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرارات استثمارية.

فلورنس موتشاي

فلورنس موتشاي

تغطي فلورانس منذ 6 سنوات أخبار العملات الرقمية، والألعاب، والتكنولوجيا، والذكاء الاصطناعي. وقد زودتها دراستها لعلوم الحاسوب في جامعة ميرو للعلوم والتكنولوجيا، ودراسة إدارة الكوارث والدبلوماسية الدولية في MMUST بالمهارات اللغوية والملاحظة والتقنية اللازمة. عملت فلورانس في مجموعة VAP Group وككاتبة تحريرية في عدة وسائل إعلام متخصصة في العملات الرقمية.

المزيد من الأخبار