ماسح أمني لمهارات الوكيل
ماسح أمني بأفضل جهد ممكن لمهارات وكلاء الذكاء الاصطناعي (AI Agent Skills) يكتشف حقن الأوامر (prompt injection)، وتسريب البيانات، وأنماط الشيفرة الخبيثة. وهو يجمع بين الكشف القائم على الأنماط (YAML + YARA-X)، وتحليل AST وتدفق البيانات، وLLM-as-a-judge اختياري، وطبقة قرار CEL محدودة النطاق تعمل على حقائق الكاشفات المُصنَّفة.
مهم: يوفر هذا الماسح كشفًا بأفضل جهد ممكن، وليس تغطية شاملة أو كاملة. لا يضمن الفحص الذي لا يُرجع أي نتائج أن المهارة خالية من جميع التهديدات. راجع النطاق والقيود أدناه.
يدعم صيغ OpenAI Codex Skills وCursor Agent Skills وفقًا لـمواصفة Agent Skills. مع --lenient، يفحص أيضًا الصيغ غير القياسية مثل Claude Code .claude/commands/*.md ومستودعات المهارات بصيغة markdown المسطحة.
cel-go v0.32.0 الرسمي لربط الحقائق محدودة النطاق بعد الكشف الحتمي وقبل تحليل LLM الاختياريانضم إلى Cisco AI Discord للنقاش أو مشاركة الملاحظات أو التواصل مع الفريق.
Skill Scanner هو أداة كشف. يحدد أنماط المخاطر المعروفة والمحتملة، لكنه لا يشهد بأمان أي شيء.
القيود الرئيسية:
تحتوي معيارية التطوير النهائية للأساس + CEL على 5,256 حزمة خبيثة و1,338 حزمة حميدة من MaliciousSkillBench. وبالمقارنة مع origin/main، رفع الماسح الحالي مقياس F1 من 32.92% إلى 47.73% والاستدعاء (recall) من 19.88% إلى 31.43%، مع تقليل معدل النتائج الإيجابية الكاذبة الحميدة من 3.59% إلى 1.05%. الدقة (Precision) هي 99.16%. كانت خمس جولات CEL-shadow دقيقة وحتمية؛ وقيّمت CEL 154 مرشحًا دون اقتراح أي كبت أو اللجوء إلى بديل.
التقسيم المقفل المنفصل عن المصدر أضعف: TP=65، FP=42، TN=503، وFN=774، بدقة 60.75%، واستدعاء 7.75%، وF1 بنسبة 13.74%، ومعدل إيجابيات كاذبة (FPR) بنسبة 7.71%. وهذا يحسّن F1 مقارنة بـorigin/main (7.40%) لكنه يتراجع في FPR (3.67%)، لذا لا يجتاز بوابة الترقية. لذلك تبقى كل قاعدة CEL المضمّنة في وضع shadow؛ ولا يرقّي هذا التغيير أي كبت CEL.
وجدت فحوصات التوافق والفحوصات التكميلية نتائج متطابقة بين CEL-OFF/CEL-SHADOW على 111 مهارة رسمية من Codex وClaude Code وCursor (30 حزمة MEDIUM+ و8 حزم HIGH/CRITICAL)، مع خمس جولات مستقرة. وكان لمجموعة NotInject للسلبيات الصعبة 0/339 تطابقًا قابلًا للتنفيذ. وكان لدى HarmfulSkillBench 7/200 حزمة قابلة للتنفيذ و6/200 حزمة HIGH+ مع عينة واحدة محجورة، بينما كان لدى OpenSkillRisk 76/263 حزمة قابلة للتنفيذ مع حجرين مضيفين. والأخيرتان تشخيصيتان للاستدعاء الإيجابي فقط ولا يمكنهما قياس الدقة أو FPR. نتائج ATR الاختيارية خارج نطاق هذا الإصدار. راجع تقييم الكشف والطرح للمنهجية والمصدر وفواصل الثقة والقيود.