مايكروسوفت وOpenAI

تسريبات تكشف مخاوف Microsoft وOpenAI من سرقة الأخبار

تكشف وثائق قضائية أُفرج عنها حديثًا رسائل داخلية من Microsoft وOpenAI حول استخدام محتوى الأخبار في تدريب الذكاء الاصطناعي، وسط مخاوف من تراجع زيارات المواقع الإخبارية وتهديد نموذجها الاقتصادي.

تفاصيل الخبر

أظهرت ملفات قضائية غير مختومة في القضية التي تضم مؤسسات إخبارية كبرى، من بينها The New York Times، نقاشات داخلية في Microsoft وOpenAI حول تأثير جمع الأخبار وتدريب نماذج الذكاء الاصطناعي عليها. وتأتي الوثائق في إطار نزاع قانوني أوسع حول حقوق النشر واستخدام المحتوى لتدريب نماذج الذكاء الاصطناعي.

ومن أبرز ما ورد في الوثائق حول Microsoft وOpenAI:

  • وصف Brent Hecht، مدير العلوم التطبيقية في Microsoft، عملية جمع الأخبار لتدريب الذكاء الاصطناعي بأنها «سرقة مذهلة وغير مسبوقة»، ووصفها بأنها قد تكون «أكبر سرقة للعمالة في تاريخ البشرية».
  • أشارت رسائل داخلية في OpenAI إلى مخاوف من أن تواجه المؤسسات الصحفية تهديدًا وجوديًا مع قدرة روبوتات المحادثة على تقديم المعلومات بدلًا من زيارة المواقع الأصلية.
  • تحدثت إحدى وثائق Microsoft عن احتمال حدوث «حلقة مفرغة»؛ إذ يمكن لتراجع إنتاج الأخبار أن يقلل المحتوى عالي الجودة المتاح مستقبلًا لتدريب أنظمة الذكاء الاصطناعي.
  • وفقًا للوثائق التي استشهدت بها المؤسسات الإخبارية، سجلت Microsoft انخفاضًا في معدلات النقر على بعض المواقع الإخبارية تراوح بين 51% و94% لدى بعض الجهات، وبين 83% و93% لدى جهات أخرى.
  • كشفت الملفات أيضًا عن ادعاءات بشأن استخدام مجموعات بيانات تحتوي على أعداد كبيرة من الأعمال المنشورة، من بينها أكثر من 91 ألف نسخة من أعمال لمؤسسات إخبارية ضمن مجموعات بيانات التدريب في OpenAI.
  • Microsoft ردت بأن تصريحات Hecht تمثل وجهة نظر شخصية لموظف ولا تُعد تحليلًا قانونيًا أو موقفًا رسميًا للشركة، كما أكدت أن منتجاتها المعتمدة على الذكاء الاصطناعي تمثل استخدامًا تحويليًا للمحتوى ولا تستبدل المواقع الإخبارية.

الأهداف المستقبلية وتأثير القضية على الذكاء الاصطناعي

من المتوقع أن تركز المرحلة المقبلة من النزاع على كيفية استخدام المحتوى المحمي بحقوق النشر، وما إذا كانت مخرجات روبوتات المحادثة تؤدي إلى استبدال المصادر الأصلية بدلًا من توجيه المستخدمين إليها.

ومن أبرز الملفات التي قد تحظى باهتمام أكبر:

  • وضع قواعد أكثر وضوحًا لاستخدام الأخبار في تدريب نماذج الذكاء الاصطناعي.
  • بحث نماذج ترخيص المحتوى بين شركات الذكاء الاصطناعي والمؤسسات الإعلامية.
  • الحد من إنتاج مقتطفات طويلة أو نصوص مطابقة للمصادر الأصلية.
  • حماية تدفق الزيارات والإيرادات الذي تعتمد عليه المؤسسات الصحفية.
  • تحديد حدود استخدام المحتوى المنشور على الإنترنت ضمن مفهوم الاستخدام العادل (Fair Use).
  • إيجاد توازن بين تطوير الذكاء الاصطناعي والحفاظ على الحوافز الاقتصادية لإنتاج الأخبار والمحتوى الأصلي.

وتظل هذه النقاط جزءًا من نزاع قانوني مستمر، ولا تعني الوثائق المسربة وحدها أن المحكمة حسمت مسألة حقوق النشر أو الاستخدام العادل لصالح أي طرف.

تكشف الوثائق الجديدة Microsoft وOpenAI عن حجم التعقيد الذي يحيط بعلاقة الذكاء الاصطناعي بصناعة الأخبار، خصوصًا مع تزايد اعتماد النماذج على المحتوى المنشور على الإنترنت. ومع استمرار القضية، قد تسهم نتائجها في تحديد قواعد جديدة لكيفية استخدام الأخبار والمحتوى المحمي بحقوق النشر في تطوير تقنيات الذكاء الاصطناعي مستقبلًا.

مقالات مشابهة