Z.ai تطلق GLM-5.3 بنموذج أقوى للبرمجة والمهام السيبرانية
أطلقت Z.ai نموذج GLM-5.3 الجديد مع تحسينات كبيرة في البرمجة والمهام طويلة الأمد، إلى جانب قدرات متقدمة في اكتشاف الثغرات الأمنية واستغلالها، مع قرب إتاحة أوزانه للمطورين.

تفاصيل خبر GLM-5.3
كشفت Z.ai عن نموذج GLM-5.3، الذي يعتمد على النموذج الأساسي نفسه المستخدم في GLM-5.2، لكن الشركة ركزت في الإصدار الجديد على توسيع نطاق التدريب اللاحق باستخدام مهام أكثر تعقيداً وبيئات تحاكي العمل الحقيقي للمطورين والباحثين.
ومن أبرز النتائج التي أعلنت عنها الشركة:
- تحسن أداء GLM-5.3 بنسبة 50% مقارنةً بـ GLM-5.2 في اختبار Z.ai الداخلي للبرمجة.
- ارتفاع نتيجته في Terminal-Bench 3.0 من 4.6 إلى 28.3.
- ارتفاع أدائه في DeepSWE v1.1 من 46.2 إلى 66.9.
- حقق 84.5% في CyberGym، متفوقاً على عدد من النماذج المنافسة في اختبار اكتشاف الثغرات.
- سجل 54.4% في ExploitBench، مقارنةً بـ24.4% للنموذج السابق.
- تمكن من إنجاز 105 مهام في ExploitGym خلال ساعتين و130 مهمة خلال ست ساعات، وفق منهجية الاختبار التي أعلنتها الشركة.
- أظهر تحسناً في كفاءة استخدام الرموز، إذ حقق نتائج أعلى مع عدد أقل من الرموز في بعض مستويات الجهد.
- يدعم ثلاثة مستويات للتفكير: منخفض، عالٍ، وأقصى، مع توصية باستخدام المستوى الأقصى لمهام البرمجة.
وتشير Z.ai أيضاً إلى أن قدرات النموذج في الأمن السيبراني تطورت بصورة أسرع من المتوقع مع زيادة حجم التدريب. ووفق الشركة، ساعد النموذج فرقاً أمنية في فحص مشاريع برمجية حقيقية، حيث جرى تحديد 2,436 ثغرة في 269 مشروعاً مفتوح المصدر، من بينها 1,097 ثغرة متوسطة إلى عالية الخطورة.
الأهداف المستقبلية لـ GLM-5.3
لا تركز Z.ai على تحسين نتائج الاختبارات فقط، بل تسعى إلى جعل GLM-5.3 أكثر قدرة على تنفيذ المهام البرمجية المعقدة من البداية إلى النهاية، مع تقليل الحاجة إلى تدخل المستخدم في كل خطوة.
وتتمثل أبرز الخطوات المستقبلية في:
- إتاحة أوزان GLM-5.3 للعامة بعد استكمال اختبارات السلامة والتحصين.
- مواصلة تطوير بيئات تدريب تحاكي مهام المهندسين والباحثين في العالم الحقيقي.
- زيادة أتمتة إنشاء بيئات التدريب والتحقق من النتائج.
- تحسين قدرة النموذج على تنفيذ المهام طويلة الأمد باستقلالية أكبر.
- تطوير قدرات التدريب اللاحق باستخدام إطار slime مفتوح المصدر.
- رفع كفاءة التدريب وتقليل الموارد المطلوبة لتدريب النماذج المستقبلية.
- مواصلة البحث في قدرات الأمن السيبراني مع التركيز على الاختبارات والتقييمات الآمنة.
وتخطط Z.ai لإتاحة أوزان النموذج بشكل مفتوح بعد نحو أسبوعين من الإطلاق، عقب الانتهاء من تقييمات السلامة. كما أصبح GLM-5.3 متاحاً لمشتركي خطة GLM Coding Plan، ويمكن استخدامه عبر أدوات برمجية مثل ZCode وغيرها.
يمثل GLM-5.3 خطوة جديدة لـZ.ai في سباق نماذج البرمجة والذكاء الاصطناعي الوكيلي، خصوصاً مع التحسن الكبير في المهام طويلة الأمد والاختبارات السيبرانية. وإذا أوفت الشركة بموعد إطلاق الأوزان، فقد يصبح النموذج خياراً مهماً للمطورين والباحثين الراغبين في استخدام نموذج مفتوح الأوزان بقدرات متقدمة.
