عمالقة التكنولوجيا يدفعون الحدود لتغذية جوع الذكاء الاصطناعي للبيانات

- تلجأ عمالقة التكنولوجيا إلى طرق مثيرة للجدل لجمع بيانات الذكاء الاصطناعي.
- تقوم شركة OpenAI بنسخ مقاطع فيديو من YouTube، وتفكر Google وMeta في شراء المحتوى المحمي بحقوق الطبع والنشر.
- تثار نقاشات قانونية وأخلاقية حول استخدام الذكاء الاصطناعي لمجموعات البيانات الضخمة.
سواء كان الأمر يتعلق بعمل OpenAI، وجوجل، وميتا، أو تمويل الذكاء الاصطناعي للقطاع الصناعي، الذي يتضمن وسائل مختلفة مثل جمع أو تراكم أحجام هائلة من البيانات الرقمية بطرق إبداعية ولكن مثيرة للجدل، فمن الواضح أن قدرات وآليات الأتمتة تزداد. ومن الملاحظ أن الجهود التي تنطوي على إجراءات مثل اتخاذ التدابير الموضحة أعلاه (أي، أخذ الحدود القانونية والسياسات المؤسسية في الاعتبار) تعادل كمية البيانات الكبيرة المستخدمة لتدريب أنظمة الذكاء الاصطناعي.
مبادرة وِسبر من OpenAI: تعدين محادثات يوتيوب
بدأت قصة وِسبر لدينا منذ عام فقط. هناك نقص هائل في النصوص الإنجليزية من الدرجة الأولى مما يسبب تأخيرات في تقديم التعليم. كانت وِسبر الخطوة التالية من قبل جوجل. لقد فهمت محيط الحوارات في يوتيوب وتم تطويرها كتطبيق لتحويل النص إلى كلام. وقد تم استخدام الأداة المدعومة بالذكاء الاصطناعي نفسها، والتي تتكون من أكثر من مليون ساعة من مقاطع فيديو يوتيوب التي تم تدقيقها بالذكاء الاصطناعي لتوليد نصوص جديدة (في الأساس، محادثة جديدة)، لتدريب نماذج الذكاء الاصطناعي المنتجة من أحدث التقنيات وصولاً إلى GPT-4، أحدث إصدار من روبوت الدردشة ChatGPT.
على الرغم من أن بعض الموظفين جادلوا بأن لقطات مايكروسوفت لـ OpenAI ستنتهك حقوق يوتيوب من كل جانب، إلا أن أخلاقيات الانتحال كانت لا تزال قابلة للنقاش؛ بالإضافة إلى ذلك، اعترف بعض العمال بأنه سيكون من المستحيل المواءمة بدقة مع نوايا يوتيوب. وبالمثل، قد يكون الحصول على اعتراض في معالجة مقاطع الفيديو خوارزمياً لاستخراج المحتويات النصية لتغذية نماذج الذكاء الاصطناعي قد اعتبر تهديداً لحقوق النشر لمصنعي الفيديو، مما تسبب في غضب.
ميتا، الشركة الأم لفيسبوك وإنستغرام، كانت قلقة أيضاً بشأن استخدام عناصر محمية بحقوق النشر من دور النشر مثل سايمون وشوستر، من بين آخرين. وفي الوقت نفسه، ناقشت أيضاً الحصول على محتوى الويب العام، ربما لتقع في فخ انتهاك حقوق النشر.
ضغط البيانات: دفع النهج غير التقليدية
جمع البيانات المليء بالمنافسة يساعد على ملاحظة الموقع المحوري للبيانات وتحديد دوره في تطوير تكنولوجيا الذكاء الاصطناعي. تتطلب لغات الذكاء الاصطناعي مجموعات تدريبية متزايدة، بما في ذلك الكومنولث، والتي يتم التلاعب بها حتى ويكيبيديا وريديت من خارج هذه المصادر اليوم. بالنسبة لشركات التكنولوجيا - خاصة تلك التي تواجه صعوبة في الوصول إلى مصادر البيانات الشائعة جداً مثل متاجر البيانات التقليدية - يمكن أن يكون إنشاء نماذج مدعومة بالذكاء الاصطناعي حلاً بديلاً قد يكون مرغوباً فيه بما فيه الكفاية في مثل هذه الحالات.
تشير شركات التكنولوجيا إلى أن جمع البيانات ضروري لتدريب الذكاء الاصطناعي، بينما يخضع نفس العملية للسؤال القانوني في المحكمة. في دفاعهم، فاز OpenAI ومايكروسوفت بدعوى حول الاستخدام غير القانوني للمواد المحمية بحقوق النشر ضدهم. ومع ذلك، قالوا إن أفعالهم تقع ضمن المبدأ القانوني للاستخدام العادل. في السنوات الأخيرة، تجاوز عدد الطلبات المقدمة إلى مكتب حقوق النشر في الولايات المتحدة من قبل أصحاب حقوق النشر عدد 10,000، مما يظهر بوضوح أن قانون حقوق النشر في عصر الذكاء الاصطناعي فريد وجديد. ونتيجة لذلك، يواجه اللاعبون الرئيسيون دائماً مخاطر تتعلق بانتهاك العديد من الأعمال تحت ذريعة عدم وجود أغراض مرخصة للنماذج التي تستخدم الذكاء الاصطناعي على هذا الأساس.
الضرورة الحتمية لمجموعات البيانات الضخمة
بشكل عام، كان عمل كايبان جاريدي، العالم في مجال النطاق، غير مقصود ولكنه ملحمي في تطوير الذكاء الاصطناعي. المحتوى المدعوم بالبيانات هو أحد مكونات الذكاء الاصطناعي اللازمة لعملية التدريب، لكنه لا يمكن أن يعمل بشكل جيد دون النماذج التي تم تدريبها جيداً وتعمل بفعالية. مع زيادة تكنولوجيا الذكاء الاصطناعي، يزداد الطلب على البيانات للنجاح في السوق بمعدل مرتفع، مما يترك الشركات مع أسئلة تتعلق بالقانون والأخلاق والخصوصية. لذلك، يجب على خوارزميات الذكاء الاصطناعي استخدام مجموعات البيانات هذه للنجاح في السوق.
يتم تشويه سلوك جمع البيانات من قبل كبار الشخصيات (VIPs) لتحسينات الذكاء الاصطناعي؛ ويتم خدش القسم المنهجي المعتاد. سواء من خلال أحد محاضراتهم على يوتيوب أو إنشاء بيانات اصطناعية مولدة، فإن هذه الشركات هي قادة في مهمة اكتشاف ما هي القضايا القانونية والأخلاقية والخصوصية حقاً.
قد يصبحون مضحكاً على البحر لاحقاً. بسبب ظهور مجموعات البيانات الضخمة اللازمة لدفع عملية الابتكار، يُطلب من قادة المجتمع المشاركة بنشاط في حوار بناء لتطوير القواعد والمعايير التي يتم فيها موازنة جهود الابتكار مع المبادئ الأخلاقية لحقوق الملكية الفكرية والخصوصية.
القصة الأصلية من: https://www.nytimes.com/2024/04/06/technology/tech-giants-harvest-data-artificial-intelligence.html
أذكى العقول في عالم العملات الرقمية يقرأون بالفعل نشرتنا الإخبارية. هل تريد الانضمام؟ انضم إليهم.
إخلاء مسؤولية. المعلومات المقدمة ليست نصيحة تداول. Cryptopolitan.com لا تتحمل أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات المقدمة في هذه الصفحة. نوصي بشدة بإجراء بحث مستقل و/أو الاستعانة بمستشار مؤهل قبل اتخاذ أي قرارات استثمارية.

جيمس كينوتي
جيمس، وهو شغوف بالعملات المشفرة، يجد متعة في مشاركة المعرفة حول التكنولوجيا المالية والعملات المشفرة وتقنيات البلوكشين والتقنيات الناشئة. أحدث الابتكارات في صناعة العملات المشفرة وألعاب العملات المشفرة والذكاء الاصطناعي وتقنية البلوكشين والتقنيات الأخرى هي همّه الدائم. مهمته: مواكبة التطبيقات التحويلية في مختلف القطاعات.















