OpenAI توقف تدريب نماذج متقدمة مؤقتًا بسبب مخاوف السلامة
أعلنت OpenAI إبطاء تطوير بعض نماذجها المتقدمة مؤقتًا، بعد ظهور مؤشرات على مخاطر مرتبطة بقدراتها المتزايدة، خصوصًا في مجال الأمن السيبراني، مع تعزيز أنظمة المراقبة والمواءمة قبل استئناف أكبر عمليات التدريب.

تفاصيل الخبر
أكدت OpenAI أنها أوقفت لمدة أسبوعين تدريب التعزيز لبعض أحدث نماذجها المخصصة للنشر، بينما لا تزال أكبر عملية تدريب مستقبلية للنموذج المتقدم متوقفة مؤقتًا إلى حين إجراء المزيد من الاختبارات والتقييمات. وتأتي الخطوة بعد حادثة OpenAI-Hugging Face، إلى جانب مؤشرات أولية على أن نموذج Astra قد يصل إلى مستوى حرج من القدرات السيبرانية.
ومن أبرز تفاصيل القرار:
- أوقفت الشركة تدريب التعزيز لمدة أسبوعين على أحدث النماذج.
- لا تزال أكبر عملية تدريب مستقبلية للنماذج المتقدمة معلّقة مؤقتًا.
- تعمل OpenAI على إجراء تدريبات أصغر واختبارات إضافية لفهم سلوك النماذج.
- قررت الشركة تعزيز عزل بيئات التدريب ومنع النماذج عالية الخطورة من الوصول غير الضروري إلى الإنترنت أو الشبكات الداخلية.
- أصبح نموذج Astra يخضع لأعلى مستويات الحماية بعد تحديد احتمال امتلاكه قدرات سيبرانية حرجة.
- تستخدم الشركة أنظمة مراقبة آلية تفحص نشاط النموذج وأفعاله باستخدام الأدوات وتسلسل نشاطه لاكتشاف محاولات الوصول غير المصرح به أو سرقة البيانات أو تجاوز إجراءات الحماية.
- في حال ظهور تنبيه أمني مهم، يُمنح فريق السلامة والأمن والبحث 30 دقيقة لتحديد ما إذا كان التنبيه خاطئًا، وإلا يُتوقع إيقاف النشاط.
- تقدر الشركة حاليًا أن أنظمة المراقبة تضيف نحو 20% إلى استهلاك الحوسبة في عمليات الاستدلال التي تخضع للمراقبة.
الأهداف المستقبلية
تركز OpenAI خلال المرحلة المقبلة على تحقيق توازن بين سرعة تطوير النماذج المتقدمة ومستوى الأمان المطلوب قبل تشغيلها على نطاق واسع. وتقول الشركة إن قدرات النماذج تتطور بسرعة، ولذلك يجب أن تتقدم معها أنظمة المراقبة والمواءمة والأمن بوتيرة أسرع.
وتعمل الشركة على ثلاثة محاور رئيسية:
- المراقبة: اكتشاف السلوكيات المثيرة للقلق والاستجابة لها بسرعة.
- المواءمة: تقليل احتمالية قيام النماذج بتصرفات ضارة أو غير مصرح بها.
- الأمن: الحد من قدرة النماذج على الوصول إلى الأنظمة والموارد التي يمكن أن تؤثر فيها.
كما تعتزم OpenAI تطوير إطار Preparedness Framework الحالي ليشمل هذه الإجراءات بصورة أكثر تكاملًا خلال مراحل التدريب والنشر. وستواصل الاستثمار في أبحاث المواءمة، ونماذج المكافآت، والتقييمات الأمنية، بالإضافة إلى استخدام الذكاء الاصطناعي نفسه للمساعدة في اختبار الحدود الأمنية بصورة مستمرة.
وتشير الشركة إلى أن الهدف ليس إيقاف تطوير النماذج المتقدمة، وإنما التأكد من امتلاكها أدلة أقوى على السلوك المتوافق مع أهدافها قبل الانتقال إلى عمليات تدريب أكبر. ومن المنتظر أيضًا نشر تقرير تقني يوضح الدروس التي توصلت إليها OpenAI خلال الأسابيع المقبلة.
تكشف خطوة الشركة عن التحدي المتزايد الذي تواجهه شركات الذكاء الاصطناعي مع ارتفاع قدرات النماذج، خصوصًا عندما تبدأ في التعامل مع الأدوات والأنظمة الخارجية. وقد يصبح تعزيز السلامة والمواءمة جزءًا أساسيًا من سرعة تطوير النماذج المستقبلية، وليس مرحلة منفصلة عنها.
