أنثروبيك: GLM-5.3 قادر على الاختراق بضوابط أمان ضعيفة
تقرير اختبار هجومي من أنثروبيك يزعم أن نموذج GLM-5.3 من تشيبو ايه آي يملك قدرات اختراق بمستوى Mythos مع ضوابط يمكن تجاوزها.
نشرت شركة أنثروبيك تقريراً من فريق الاختبار الهجومي المتقدم (Frontier Red Teaming) تزعم فيه أن نموذج GLM-5.3 مفتوح الأوزان من تطوير تشيبو ايه آي يمكنه توليد محتوى ضار واستخدامه في هجمات إلكترونية، مع ضوابط أمان ضعيفة. وذكر التقرير أن هذه الضوابط يمكن تجاوزها عبر مطالبات خادعة، وتعبئة رموز التفكير مسبقاً، وتقنية الإزالة (abliteration).
نتائج الاختبارات
في اختبار Exploitbench التابع لـ أنثروبيك، طور GLM-5.3 استغلالات كاملة من البداية إلى النهاية 50 مرة في 410 محاولات، مقابل 56 مرة لـ Claude Mythos. وفي اختبار داخلي لعمليات اختطاف مسار التحكم الكامل، سجل GLM-5.3 نسبة نجاح 4% مقابل 6% لـ Mythos، بينما سجل Kimi K3 و DeepSeek V4.1 Flash نسبة 0%.
وأشار التقرير إلى أن إزالة الضوابط من GLM-5.3 خفضت معدل الرفض إلى 6%، بينما بلغ معدل الرفض في GLM-5.3-Flash 14%.
يأتي هذا التقرير بعد أن نشر Center for AI Standards and Innovation في أواخر سبتمبر تقريراً يزعم أن GLM-5.3 يمكنه أتمتة الاستغلالات بالكامل بمستوى مشابه لنموذج Claude Mythos غير المُصدر من أنثروبيك.
وكانت أنثروبيك قد طورت Project Glasswing لمنح المطورين إمكانية الوصول إلى نموذج ذكاء اصطناعي بمستوى Mythos لسد الثغرات وإصلاح نقاط الضعف قبل إصدار مثل هذه النماذج. كما أصدرت Claude Opus 5.5 و Claude Sonnet 5.5 بعد أيام من إثارة مخاوف بشأن وتيرة تطوير الذكاء الاصطناعي.
أسئلة سريعة
ما هو GLM-5.3؟
نموذج ذكاء اصطناعي مفتوح الأوزان من تطوير تشيبو ايه آي، وصفه تقرير أنثروبيك بأنه يملك ضوابط أمان ضعيفة يمكن تجاوزها.
كم مرة طور GLM-5.3 استغلالات كاملة في اختبار Exploitbench؟
50 مرة في 410 محاولات، مقابل 56 مرة لـ Claude Mythos.
ما نسبة نجاح GLM-5.3 في اختبار اختطاف مسار التحكم الكامل؟
4% مقابل 6% لـ Mythos، بينما سجل Kimi K3 و DeepSeek V4.1 Flash نسبة 0%.