- ربما استخدم بعض عمالقة التكنولوجيا نصوص يوتيوب دون إذن لتدريب نماذج الذكاء الاصطناعي.
- شرعية استخدام قواعد بيانات غير مصرح بها لتدريب الذكاء الاصطناعي غير محددة، مما قد يعيق التطوير المستقبلي للذكاء الاصطناعي.
رأينا
تطوير تكنولوجيا الذكاء الاصطناعي واعد بالتأكيد، لكن إنشائه وتقدمه يعتمدان على قواعد البيانات. نقص الشفافية في قواعد البيانات هذه هو مصدر للجدل حتماً. غالباً ما يكون للجهات المتضررة والشركات المخالفة وجهات نظر متباينة، دون وجود حل نهائي في الأفق. هذا الوضع يشبه سيف داموكلس المعلق فوق الصناعة؛ إذا لم يتم التعامل معه، فسيعيق حتماً التطوير المستمر للذكاء الاصطناعي.
— ياسمين لوه، صحفية في BTW
ماذا حدث؟
تُتهم بعض شركات التكنولوجيا الكبيرة باستخدام نصوصيوتيوبدون إذن لتدريب نماذج الذكاء الاصطناعي الخاصة بها.
وفقًا لـProof News، أنشأتEleutherAI، وهي منظمة غير ربحية، مجموعة بيانات تحتوي على نصوص من أكثر من 48000 قناة يوتيوب، بما في ذلك محتوى من مبدعين بارزين مثل Marques Brownlee وMrBeast، بالإضافة إلى ناشرين كبار مثلThe New York TimesوBBCوABC News. وفقًا لتحقيق جديد من Proof News، استخدمتAppleوNVIDIAوAnthropicوشركات تكنولوجيا كبيرة أخرى هذه المجموعة لتدريب نماذج الذكاء الاصطناعي الخاصة بها.
Neal Mohan، الرئيس التنفيذي ليوتيوب، صرح سابقًا: "الشركات التي تستخدم بيانات يوتيوب لتدريب نماذج الذكاء الاصطناعي ستنتهك شروط استخدام المنصة."
Marques Brownlee، يوتيوبر مشهور، نشر على وسائل التواصل الاجتماعي: "حصلت Apple على بيانات للذكاء الاصطناعي من عدة شركات. إحداها استولت على أطنان من البيانات/نصوص فيديوهات يوتيوب، بما في ذلك فيديوهاتي. تقنيًا، Apple تتجنب أن تكون مخطئة هنا لأنها ليست من تسحب البيانات. لكن هذه ستكون مشكلة متطورة لفترة طويلة."
حاليًا، لم تعلق Apple وNVIDIA وAnthropic وEleutherAI على القضية.
اقرأ أيضًا:PDG المدعوم من Warburg يخطط لتوسع مراكز البيانات المعتمدة على الذكاء الاصطناعي في آسيا
اقرأ أيضًا:مشروع 'Strawberry' من OpenAI يطور تفكير الذكاء الاصطناعي
لماذا هذا مهم
النمو السريع لنماذج الذكاء الاصطناعي، رغم أنه واعد في تشكيل المستقبل، أثار أيضًا العديد من الأسئلة القانونية التي لم تُحل. الاتهامات الأخيرة ضد عمالقة التكنولوجيا تزيد من هذه المخاوف. منذ إنشائها، تواجه تكنولوجيا الذكاء الاصطناعي مشكلة قواعد بيانات التدريب غير الشفافة. إذا لم تأت بيانات تدريب الذكاء الاصطناعي من مصادر مناسبة، فهناك خطر انتهاك حقوق النشر أو حقوق قواعد البيانات.
ومع ذلك، لا يزال من غير المحدد ما إذا كانت الشركات المعنية ستواجه إجراءات قانونية. أجرتThe Vergeتحقيقًا بين محامين ومحللين وموظفي شركات ناشئة في الذكاء الاصطناعي، وكشفت عن آراء متباينة حول هذه القضية.
"أرى أشخاصًا من كلا الجانبين واثقين جدًا في مواقفهم، لكن الحقيقة هي أن لا أحد يعلم"، يقول بايو، مراقب الذكاء الاصطناعي.
على الرغم من أن الشركات أو الأفراد المعنيين يؤكدون أن هذا غير قانوني، إلا أن مطالبهم من غير المرجح أن تتم معالجتها، كما يتضح من عدم وجود رد من الشركات المتهمة.
إذا لم يتم حل هذه المشكلة، فقد تعيق في يوم من الأيام التطوير المستمر لتكنولوجيا الذكاء الاصطناعي.

