استغرقت Anthropic 81 يومًا لتحذيرها من التلميح الجنائي الكاذب الصادر عن ذكائها الاصطناعي

- أرسل نموذج ذكاء اصطناعي تابع لشركة Anthropic تلميحًا جنائيًا كاذبًا إلى شرطة فيلادلفيا عبر نموذج ويب عام في 18 يوليو.
- اكتشفت أنثروبيك التلميح في 28 سبتمبر وأبلغت الشرطة في 7 أكتوبر، بعد 81 يوماً من إرساله.
- اعتبرت شرطة فيلادلفيا التأخير الممتد لشهرين في اكتشاف الحادث والإبلاغ عنه أمراً غير مقبول.
استغرقت أنثروبيك 81 يوماً لإخطار شرطة فيلادلفيا بأن أحد نماذج الذكاء الاصطناعي لديها قد قدم تلميحاً كاذباً بشأن جريمة قتل عبر نموذج ويب عام.
شرطة فيلادلفيا تصف التأخير الممتد لشهرين بأنه غير مقبول
قدم النموذج التلميح في 18 يوليو. وقالت الإدارة إن التأخير الممتد لشهرين كان غير مقبول.
نُشر التقديم على موقع PhillyUnsolvedMurders.com، وهو منتدى التلميحات العامة للجرائم القتل غير المحلولة التابع لشرطة فيلادلفيا، في الساعة 11:27 مساءً يوم 18 يوليو، وفقاً لتصريح أصدرته الإدارة يوم الجمعة. زعم التقديم أنه صادر عن شخص قد يكون لديه معرفة بحادثة قتل غير محلولة.
صنّف النظام التلميح على أنه رسائل مزعجة (سبام). وبقي في تلك المجلد ولم يصل إلى المحققين أبداً.
لم يتم الوصول إلى أي بيانات خاصة بالمدينة أو الشرطة، حسبما قال المتحدث باسم الشرطة الرقيب إريك غريب.
تتم مراجعة كل دليل من قبل بشري قبل اتخاذ أي إجراء، وفقاً للإدارة. وأضافوا أن التلميح لم يصل إلى مركز الجرائم في الوقت الفعلي ليتم فحصه.
اكتشفت أنثروبيك المشكلة في 28 سبتمبر. وأبلغت الشرطة عن الحادث في 7 أكتوبر، واجتمعت الجانبان يوم الخميس.
«إن التأخير لمدة شهرين في اكتشاف الحادث وإبلاغ المدينة به أمر غير مقبول»، قالت الوزارة. وأضافت أن على Anthropic تعزيز ضوابطها الأمنية لضمان عدم وصول حوادث مماثلة إلى أنظمة المدينة دون علم المدينة.
قالت إدارة الشرطة إن إجراءات الحماية حدّت من الضرر، لكنها لم تخفِ خطورة تقديم ذكاء اصطناعي معلومات كاذبة وكأنها صادرة عن شخص لديه معرفة بجريمة قتل. وأكدت الإدارة أن على شركات التكنولوجيا ضمان عدم تزويد أجهزة إنفاذ القانون بمعلومات خاطئة.
تتعاون شرطة فيلادلفيا (PPD) مع الفريق التنفيذي للعمدة شيريل ل. باركر، وإدارة مدينة فيلادلفيا القانونية، ومكتب الابتكار والتكنولوجيا. كما ستستكشف إدارة باركر تدابير حماية تنظيمية بالتعاون مع الشركاء على مستوى الولاية والحكومة الفيدرالية.
أدى اختبار عشوائي لمواقع الويب إلى توجيه نموذج الذكاء الاصطناعي إلى موقع PhillyUnsolvedMurders.com
أبلغت أنثروبيك الشرطة بأن النموذج كان يختبر التفاعلات مع مواقع ويب تم اختيارها عشوائياً عندما صادف موقع PhillyUnsolvedMurders.com. وقام النموذج بتعبئة النموذج ببيانات كاذبة بشأن جريمة قتل غير محلولة.
قال غريب إن الشركة أوقفت عملية الاختبار الآلي التي أدت إلى هذا السلوك، وأضافت خطوة تحقق للاختبارات المستقبلية.
أفادت الشركة الشرطة بأنها ستصدر تقريرًا يوم الجمعة حول حادثة فيلادلفيا وغيرها من السلوكيات غير المقصودة للنماذج. وقالت الشرطة إنها أعلنت عن الأمر علنًا أولاً "من أجل الشفافية والمساءلة الحكومية الكاملة".
لقد فشلت نماذج Claude في اختبارات سابقة. وفي يوليو، أعلنت Anthropic أن ثلاثة من نماذج Claude الخاصة بها هربت من بيئات الاختبار المغلقة واخترقت الأنظمة الحية في ثلاث منظمات خارجية، كما أفادت Cryptopolitan.
نشر أحد النماذج، Mythos 5، حزمة Python ضارة تم تنزيلها وتشغيلها على 15 نظامًا حقيقيًا. وأبلغت Anthropic الشركات في 27 يوليو، بعد تسعة أيام من صدور نصيحة فيلادلفيا.
في سبتمبر، عثرت الشركة على سبب هذه الاختراقات في إعداد خاطئ ترك آلات الاختبار متصلة بالإنترنت. لكنها لم تشرح بشكل كامل سبب استمرار النماذج في الهجوم رغم المؤشرات التي تفيد بأن الأهداف حقيقية.
لم تكتشف Anthropic إلا الحادث الرابع، الذي وقع في يناير، في أغسطس. ولم تجد عملية مسح شملت حوالي 481 مليون محادثة أي حالات جديدة أو أكثر خطورة.
قال الرئيس التنفيذي لـ Anthropic، داريو أمودي، إن تطوير الذكاء الاصطناعي يحتاج إلى إبطاء وتيرته لتمكين المختبرات من بناء حواجز حماية أفضل. وذكرت OpenAI في 21 يوليو أن أحد نماذجها خرج من صندوق العزل الخاص بها ودخل إلى أنظمة الإنتاج في Hugging Face.
أذكى العقول في عالم العملات الرقمية يقرأون بالفعل نشرتنا الإخبارية. هل تريد الانضمام؟ انضم إليهم.
الأسئلة الشائعة
كيف أرسل نموذج ذكاء اصطناعي تابع لـ Anthropic نصيحة إلى شرطة فيلادلفيا؟
كان النموذج يختبر التفاعلات مع مواقع ويب مختارة عشوائيًا عندما قدم معلومات كاذبة عبر موقع PhillyUnsolvedMurders.com، وفقًا لما أفادت به Anthropic للشرطة.
لماذا غاضبة فيلادلفيا من Anthropic؟
انتظرت Anthropic حتى 7 أكتوبر للإبلاغ عن نصيحة مؤرخة في 18 يوليو، ووصفت الإدارة التأخير بأنه غير مقبول.
هل أثرت النصيحة الكاذبة على أي تحقيق؟
لا. تم تصنيف النصيحة على أنها رسائل مزعجة (spam) ولم يتم توجيهها أبدًا للتدقيق التحقيقي.
إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا تتحمل أي مسؤولية عن أي استثمارات تُجرى بناءً على المعلومات الواردة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرارات استثمارية.

راندا موسى
رندا موسى محررة وصحفية في كريبتوبوليتان تغطي التكنولوجيا والذكاء الاصطناعي والروبوتات والعملات الرقمية والاحتيال والاختراقات. عملت في مجال العملات الرقمية منذ عام 2017. شغلت مناصب في Forward Protocol وAmaZix وCryptosomniac. وتحمل رندا درجة البكالوريوس في الهندسة الكهربائية والإلكترونيات من جامعة برادفورد.
















