تقرير يكشف مراجعة بشرية لمحادثات ChatGPT ضمن Project Lily
كشف تقرير نشرته 404 Media عن برنامج داخلي لدى OpenAI يحمل اسم Project Lily، يُستخدم فيه مراجعون بشريون لتقييم محادثات حقيقية مع ChatGPT، بما فيها محادثات قد تحتوي على معلومات شخصية حساسة.

تفاصيل Project Lily ومراجعة محادثات ChatGPT
بحسب تقرير 404 Media، تعتمد OpenAI على مئات المتعاقدين لمراجعة محادثات حقيقية مع ChatGPT بهدف تقييم جودة ردود النموذج وتحسين أدائه، وذلك وفق وثائق داخلية حصل عليها الموقع.
- مراجعون بشريون: يشارك مئات المتعاقدين في قراءة وتقييم محادثات حقيقية مع ChatGPT، وليس مجرد بيانات اصطناعية.
- تقييم الردود: يقوم المراجعون بتحليل إجابات ChatGPT وتقييمها وفق معايير محددة تتعلق بجودة الإجابة ودقتها وطريقة تفاعل النموذج.
- مراجعة سياق المحادثة: تشير الوثائق التي اطلعت عليها 404 Media إلى أن المراجع قد يرى السؤال وسياق المحادثة المرتبط به، وليس بالضرورة رسالة منفردة فقط.
- المعلومات الشخصية: رغم استخدام أنظمة آلية لمحاولة إزالة بعض البيانات الشخصية، يشير التقرير إلى أن هذه الأنظمة قد لا تمنع ظهور جميع المعلومات الحساسة في المحادثات التي تصل إلى المراجعين.
- ملخصات الذاكرة: ذكرت تقارير متابعة أن بعض المراجعين قد يحصلون أيضًا على معلومات سياقية مرتبطة بالمستخدم، ما يزيد أهمية طبيعة البيانات التي يشاركها الأشخاص داخل المحادثات.
- الهدف من المراجعة: ترتبط العملية بتحسين سلوك النموذج وجودة إجاباته، بما في ذلك رصد الأخطاء والمشكلات المتعلقة بطريقة استجابته للمستخدمين.
- الإعدادات: أفادت التقارير بأن إعداد السماح باستخدام المحادثات لتحسين النماذج يكون مفعّلًا افتراضيًا في بعض حسابات المستهلكين، بينما يؤدي إيقافه إلى حماية المحادثات المستقبلية ولا يطبق بأثر رجعي على البيانات التي عولجت سابقًا.
وتسلط القضية الضوء على الفرق بين استخدام أدوات الذكاء الاصطناعي للمحادثة وبين التعامل معها باعتبارها مساحة لا يمكن أن يطلع عليها أي إنسان. كما أن وجود المراجعة البشرية ليس خاصًا بـOpenAI وحدها؛ إذ تستخدم شركات أخرى في قطاع الذكاء الاصطناعي عمليات مراجعة بشرية لأغراض تحسين النماذج، مع اختلاف السياسات والضوابط من شركة إلى أخرى.
الأهداف المستقبلية لـ Project Lily
يعكس البرنامج توجه OpenAI إلى الاعتماد على التقييم البشري لتحسين نماذجها، ويمكن تلخيص الأهداف المرتبطة بهذه العملية في النقاط التالية:
- تحسين دقة إجابات ChatGPT وجودتها.
- اكتشاف الأخطاء والمشكلات التي قد لا ترصدها أنظمة التقييم الآلية.
- تحسين طريقة تعامل النموذج مع الأسئلة المعقدة والحساسة.
- تقليل بعض السلوكيات غير المرغوبة في إجابات النموذج.
- استخدام تقييمات المراجعين لتطوير النماذج المستقبلية.
- تحسين قدرة ChatGPT على تقديم إجابات أكثر اتساقًا مع توقعات المستخدمين.
ويعيد Project Lily في الوقت نفسه طرح أسئلة مهمة حول الشفافية وخصوصية بيانات المستخدمين، خصوصًا عندما تحتوي المحادثات مع أدوات الذكاء الاصطناعي على معلومات شخصية أو مهنية أو حساسة.
يكشف تقرير 404 Media عن جانب مهم من عملية تطوير ChatGPT، حيث يمكن أن تخضع محادثات حقيقية لمراجعة بشرية بهدف تحسين النماذج. وتبرز هذه القضية أهمية فهم المستخدمين لإعدادات البيانات والخصوصية قبل مشاركة معلومات حساسة مع روبوتات المحادثة.
