OpenAI تستأنف تدريب Astra بعد تصنيفها خطرًا سيبرانيًا حرجًا

تستأنف OpenAI تدريب الإصدارات المستقبلية من Astra بعد توقف مؤقت فرضته مخاوف أمنية، معلنة أن النموذج أصبح أول نظام تصنفه الشركة ضمن مستوى «الخطر السيبراني الحرج»، مع استعدادها لإطلاقه تدريجيًا.

تفاصيل الخبر

أعلنت OpenAI استئناف تشغيل تدريب كبير لنماذج Astra بعد تطبيق متطلبات جديدة للأمان والسلامة، وذلك عقب توقف بعض عمليات التدريب بسبب حادثة Hugging Face. وتقول الشركة إن تقييماتها الجديدة أظهرت ارتفاعًا كبيرًا في قدرات Astra على اكتشاف الثغرات الأمنية وتطوير سلاسل استغلال متقدمة.

وبحسب OpenAI، يستطيع Astra، عند تزويده بالأدوات والصلاحيات المناسبة، اكتشاف ثغرات لم تكن معروفة سابقًا وتطوير طرق لاستغلالها في أنظمة محمية، حتى دون توجيه بشري مستمر.

ومن أبرز نتائج الاختبارات:

  • حقق Astra نتيجة 100% في اختبار ExploitBench لتطوير عمليات استغلال انطلاقًا من ثغرات معروفة.
  • اكتشف خلال اختبار داخلي ثغرتين من نوع Zero-Day، وتعمل OpenAI على إبلاغ الجهات المسؤولة عنهما.
  • تمكن في اختبارات متقدمة من بناء سلسلة اختراق لمتصفح تجاوزت العزل ووصلت إلى نظام التشغيل.
  • أظهر قدرة على اكتشاف ثغرات متعددة في نظام تشغيل محمي وربطها في سلسلة تصعيد صلاحيات.
  • ارتفعت نسبة رفضه لطلبات المساعدة السيبرانية المحظورة إلى 91.5% مقارنة بـ59% في GPT-5.6 Sol ضمن اختبارات كسر الحماية.
  • لم يحاول Astra تجاوز آليات المراجعة التلقائية في أحد اختبارات السلامة التي صممت لقياس هذا السلوك.

وبسبب هذه القدرات، صنفت OpenAI Astra ضمن مستوى Critical في إطار الاستعداد الخاص بها، وهو أعلى مستوى سيبراني تعلنه الشركة حتى الآن.

الأهداف المستقبلية

تخطط OpenAI لإتاحة Astra قريبًا، لكن الوصول إلى قدراته السيبرانية الأكثر تقدمًا سيكون محدودًا في البداية. وستبدأ الشركة بمجموعة صغيرة من المختبرين، قبل توسيع الاستخدام الدفاعي من خلال برنامج Daybreak Blue.

وتركز OpenAI مستقبلًا على تحقيق توازن بين الاستفادة من قدرات Astra في الدفاع السيبراني ومنع استخدامها لإحداث أضرار واسعة. ولهذا أضافت الشركة طبقات متعددة من الحماية تشمل تدريب النموذج على رفض الطلبات الضارة، وتصنيفات أمنية على مستوى النظام، ومراقبة مستمرة للسلوك.

كما ستستخدم OpenAI أنظمة لمراقبة تصرفات النموذج بهدف اكتشاف الأنشطة غير المصرح بها وإيقافها بسرعة. وقد تؤدي هذه الإجراءات أحيانًا إلى إيقاف مهام مشروعة أو إبطائها، إلا أن الشركة ترى أن هذه الاحتياطات ضرورية مع ارتفاع قدرات النماذج.

ومن المنتظر أن تكشف OpenAI عن مزيد من نتائج اختبارات السلامة والأمن والتوافق في Astra System Card عند الإطلاق، مع استمرارها في اختبار النموذج وإجراء عمليات Red Teaming قبل توسيع نطاق الوصول إليه.

يمثل النموذج مرحلة جديدة في تطوير نماذج الذكاء الاصطناعي ذات القدرات السيبرانية المتقدمة. وبينما قد تساعد هذه القدرات المدافعين على اكتشاف الثغرات، فإنها تفرض أيضًا مستوى أعلى من الحماية والمراقبة لضمان عدم تحولها إلى مصدر لخطر أمني واسع.

مقالات مشابهة