Anthropic تكشف أبرز حالات إساءة استخدام Claude حول العالم
كشفت Anthropic عن أحدث تقرير لذكاء التهديدات، موثقة حالات بارزة أُسيء فيها استخدام Claude خلال ثمانية أشهر، شملت هجمات إلكترونية وتجسساً ومراقبة واحتيالاً ومخاطر مرتبطة بالأسلحة والبيولوجيا.

تفاصيل الخبر
يوثق التقرير عمليات أساء فيها أفراد وجهات مختلفة استخدام نماذج Claude، مع تأكيد Anthropic أنها عطلت هذه الأنشطة وعززت أنظمة الحماية بعد كل حالة.
- يغطي التقرير أنشطة رُصدت بين ديسمبر 2025 وأغسطس 2026، وشملت سبعة مجالات رئيسية مثل العمليات السيبرانية، والتجسس، والمراقبة، والاحتيال، وسوء الاستخدام البيولوجي، والأسلحة التقليدية، واستخلاص النماذج.
- قالت Anthropic إنها رصدت سبع جهات صينية مرتبطة بعمليات استخلاص غير مشروعة لقدرات Claude، من بينها Alibaba وDeepSeek وMoonshot وXiaomi، باستخدام آلاف الحسابات الاحتيالية.
- أشارت الشركة إلى أن Moonshot وDeepSeek استخدمتا Claude في بعض الحالات لتقديم الخدمة لعملائهما، مع تقديم النموذج على أنه نموذج خاص بهما، ثم الاستفادة من المخرجات في التدريب.
- رصدت Anthropic خمس حالات استخدم فيها علماء Claude في سياقات بيولوجية أثارت مخاوف من إمكانية ارتباطها بتطوير أسلحة، لكنها أوضحت أنها لا تؤكد أن أصحاب هذه الحالات كانوا ينوون إلحاق الضرر.
- في إحدى الحالات، استُخدم Claude Code للمساعدة في تطوير برمجيات مرتبطة بصاروخ في اليمن، ثم عاد المستخدم إلى Claude للحصول على المساعدة بعد فشل الاختبار.
- كشف التقرير أيضاً عن استخدام Claude في عمليات مراقبة واسعة، من بينها نظام صُمم لمساعدة جهاز استخبارات في مالي على مراقبة ملايين خطوط الهاتف.
- شملت الحالات عمليات احتيال عبر تطبيقات مواعدة مزيفة، وعمليات تأثير، ومحاولات لاستنساخ أسلوب كتابة ناشط والتواصل مع معارفه.
- في المجال السيبراني، رصدت Anthropic عمليات استخدم فيها Claude لأتمتة أجزاء كبيرة من سلسلة الهجوم، بدءاً من الاستطلاع وحتى استخراج البيانات.
- أوضحت الشركة أن بعض الجهات استخدمت الذكاء الاصطناعي لتعديل أدوات برمجية ضارة وإعادة بنائها عندما تكتشفها أنظمة الحماية، ما يسمح للمهاجمين بمحاولة تجاوز وسائل الكشف بسرعة أكبر.
وتوضح هذه الحالات أن إساءة استخدام نماذج الذكاء الاصطناعي لم تعد مقتصرة على إنشاء نصوص أو محتوى ضار، بل أصبحت تشمل تنفيذ مهام أكثر تعقيداً وبدرجة متزايدة من الاستقلالية. ووفق Anthropic، استخدمت بعض العمليات أطر عمل متعددة الوكلاء لتنفيذ الاستطلاع والاستغلال واستخراج البيانات، مع بقاء البشر مسؤولين عن تحديد الأهداف ومراجعة النتائج.
الأهداف المستقبلية
تسعى Anthropic إلى الاستفادة من نتائج التقرير لتحسين قدرتها على اكتشاف إساءة استخدام Claude والتعامل معها، مع التركيز على عدة أهداف:
- تطوير أنظمة حماية أكثر قدرة على اكتشاف الاستخدامات الضارة للنماذج.
- تحسين رصد العمليات التي تستخدم الذكاء الاصطناعي لأتمتة الهجمات السيبرانية.
- مشاركة المعلومات مع الجهات الحكومية وشركات التكنولوجيا والجهات المتخصصة في الأمن السيبراني.
- تعزيز القدرة على اكتشاف محاولات التحايل على إجراءات السلامة.
- الحد من استخدام Claude في تطوير عمليات التجسس والمراقبة والاحتيال.
- مواجهة عمليات استخلاص قدرات النماذج واستخدامها بصورة غير مشروعة.
- مواصلة تحديث إجراءات الحماية مع تطور قدرات نماذج الذكاء الاصطناعي.
يكشف تقرير Anthropic أن قدرات Claude المتقدمة يمكن أن تكون مفيدة في مجالات واسعة، لكنها قد تتحول أيضاً إلى أداة يستغلها المهاجمون والجهات الإجرامية. ومع تطور النماذج، سيصبح تحسين أنظمة الحماية ورصد إساءة الاستخدام جزءاً أساسياً من مستقبل الذكاء الاصطناعي الآمن.
