الذكاء الاصطناعي

باحث يكشف هجمات استغلال ثغرات الثقة في بروتوكول MCP بين وكلاء الذكاء الاصطناعي

هجمات إثبات مفهوم تستغل الثقة بين وكلاء الذكاء الاصطناعي الداخليين لنشر تعليمات ضارة، واختُبرت على وكلاء لدى جوجل وJP Morgan Chase وWeviate وRapid7 وجهات حكومية.

كشف باحث مستقل عن هجمات إثبات مفهوم تستغل فجوات الثقة في Model Context Protocol (MCP) لنشر تعليمات ضارة من وكيل ذكاء اصطناعي إلى آخرين داخل المؤسسات، بحسب ما أوردته Ars Technica. وتستهدف هذه التقنية الثقة القائمة بين الوكلاء الداخليين، ما يسمح بانتقال التعليمات الضارة عبر الشبكة.

وتُعد هذه الهجمات شكلًا من أشكال حقن التعليمات (prompt injection) الموجّه إلى وكيل محدد بدلًا من استهداف النموذج اللغوي الكبير نفسه. وبهذه الطريقة، يمكن للتعليمات المصممة بعناية أن تنتشر بين الوكلاء دون أن تتعرض النماذج نفسها للاستغلال المباشر.

جهات اختُبرت ونتائج الهجمات

اختبر الباحث وكلاء لدى Google وJP Morgan Chase وWeviate وRapid7، إضافة إلى المديرية العامة للرقمنة بين الوزارات في الحكومة الفرنسية والحكومة الفيدرالية الأمريكية. وأفضت التعليمات المصممة بعناية في حالات كثيرة إلى هجمات تزوير الطلبات من جانب الخادم (server-side request forgery).

وفي سياق سابق، أقرّت Google وأربع مؤسسات أخرى خلال الأشهر الخمسة الماضية بوجود ثغرات تُستغل عبر وكيل واحد داخل شبكة مستهدفة لنشر تعليمات ضارة إلى وكلاء داخليين آخرين.

أسئلة سريعة

ما هو Model Context Protocol؟

هو بروتوكول يُستخدم لتنظيم التواصل بين وكلاء الذكاء الاصطناعي، وقد استُغل في هجمات إثبات المفهوم عبر الثقة بين الوكلاء الداخليين.

ما نوع الهجوم الذي كشفه الباحث؟

هو شكل من أشكال حقن التعليمات يستهدف وكيلًا محددًا بدلًا من النموذج اللغوي الكبير نفسه، ما يسمح بنشر تعليمات ضارة بين الوكلاء.

ما الجهات التي اختُبرت وكلاؤها؟

Google وJP Morgan Chase وWeviate وRapid7، إضافة إلى المديرية العامة للرقمنة بين الوزارات في الحكومة الفرنسية والحكومة الفيدرالية الأمريكية.

المصدر