أمازون

Amazon تشتري كتبًا نادرة لتدريب نماذج الذكاء الاصطناعي

تكشف تحقيقات جديدة أن Amazon تشتري كميات كبيرة من الكتب النادرة والمستعملة، ثم تفكك أغلفتها وتمسح صفحاتها ضوئيًا لاستخدام محتواها في تطوير منتجات الذكاء الاصطناعي، قبل التخلص من النسخ الورقية.

تفاصيل الخبر

كشفت تحقيقات 404 Media عن عملية غير معلنة سابقًا لشراء الكتب بكميات كبيرة، بعد تتبع شحنة من الكتب النادرة انتهت في منشأة تابعة لـ Amazon في لاس فيغاس.

وتشمل أبرز تفاصيل العملية:

  • تتلقى منشأة VGT3 في لاس فيغاس شحنات ضخمة من الكتب المطبوعة.
  • يقوم العاملون بقطع أغلفة وتجليد الكتب لتسهيل إدخال الصفحات إلى أجهزة المسح الضوئي بسرعة أكبر.
  • يتم مسح محتوى الكتب وتحويله إلى بيانات رقمية يمكن استخدامها في تطوير منتجات الذكاء الاصطناعي.
  • تؤدي عملية إزالة التجليد إلى تدمير النسخ الورقية من الكتب.
  • تمكن تحقيق 404 Media من تتبع إحدى الشحنات بعد وضع جهاز تتبع داخل كتاب ضمن طلب كبير.
  • وصلت الشحنة في النهاية إلى منشأة أمازون المعروفة باسم LAS8 في لاس فيغاس، حيث توجد وحدة VGT3.
  • تشير التقارير إلى أن بعض الطلبات تضم أعدادًا كبيرة ومتنوعة من الكتب، بما في ذلك كتب نادرة وقديمة.
  • قالت Amazon إنها تشتري الكتب عبر قنوات تجارية بهدف تطوير وتحسين المنتجات والخدمات التي يستخدمها عملاؤها، لكنها لم تكشف بالتفصيل عن النماذج أو المنتجات التي تستخدم هذه البيانات في تدريبها.

ويأتي هذا الاتجاه في وقت تبحث فيه شركات الذكاء الاصطناعي عن مصادر جديدة للنصوص عالية الجودة لتدريب نماذجها. وتكتسب الكتب القديمة والنادرة أهمية خاصة لأنها قد تحتوي على محتوى غير متاح بسهولة على الإنترنت، كما أن الأعمال المنشورة قبل انتشار النصوص المولدة بالذكاء الاصطناعي توفر مصدرًا أقل عرضة لمشكلة الاعتماد المتكرر على محتوى مولد آليًا.

الأهداف المستقبلية

يبدو أن الهدف الأساسي من هذه العملية هو توفير كميات كبيرة من المحتوى النصي عالي الجودة لتطوير منتجات وخدمات Amazon المعتمدة على الذكاء الاصطناعي. وقد يساعد تحويل الكتب المطبوعة إلى بيانات رقمية في توسيع مصادر التدريب المتاحة للنماذج.

ومن أبرز الأهداف المحتملة:

  • توفير بيانات نصية متنوعة لتطوير نماذج الذكاء الاصطناعي.
  • رقمنة كتب قديمة أو نادرة يصعب العثور على نسخ رقمية منها.
  • تحسين قدرة النماذج على فهم أساليب الكتابة والمعلومات المتخصصة.
  • تطوير منتجات وخدمات ذكاء اصطناعي أكثر قدرة على التعامل مع المحتوى الطويل.
  • الوصول إلى مصادر بيانات لم تكن متاحة بسهولة من خلال الإنترنت.
  • بناء مجموعات بيانات واسعة يمكن استخدامها في تطوير تقنيات الذكاء الاصطناعي المستقبلية.

لكن هذه الممارسة تثير أيضًا نقاشًا حول حقوق النشر والحفاظ على التراث الثقافي، خصوصًا عندما يتعلق الأمر بكتب نادرة أو ذات قيمة تاريخية. كما تطرح طريقة المسح التي تؤدي إلى تدمير النسخة الأصلية سؤالًا حول إمكانية استخدام أساليب غير مدمرة للحفاظ على الكتب مع الاستفادة من محتواها رقميًا.

تكشف عملية Amazon عن جانب جديد من سباق الحصول على بيانات عالية الجودة لتدريب الذكاء الاصطناعي، حيث لم تعد المصادر الرقمية وحدها كافية لبعض الشركات. وبينما يمكن لهذه العملية توفير كميات كبيرة من المحتوى للنماذج، فإن تدمير الكتب النادرة يفتح نقاشًا مهمًا حول التوازن بين تطوير الذكاء الاصطناعي والحفاظ على المعرفة والتراث المكتوب.

مقالات مشابهة