#1أدوات أمان LLM وحقن المطالبات واستخراج النماذج والذكاء الاصطناعي العدائي وأدوات الفريق الأحمر للذكاء الاصطناعي.
موصى به من Kitploit

أداة توجيه ومرجع حتمي لوكلاء الذكاء الاصطناعي الهجوميين المستقلين، تفرض بوابات التفويض والنطاق والأدلة لضمان اختبار اختراق قابل للتكرار وصادق.

# وقت تشغيل WASM قائم على القدرات لتنفيذ كود غير موثوق مولّد بالذكاء الاصطناعي وقت تشغيل WASM قائم على القدرات لتنفيذ كود غير موثوق مولّد بالذكاء…

نظام تدقيق أمني سياقي للقطع الأثرية البحثية

معيار لتقييم مخاطر السلامة للوكلاء الذين يستخدمون الحاسوب، مع 104 سيناريوهات إساءة استخدام واقعية عبر سبع فئات خبيثة، مع دعم الوصول إلى الطرفية وتتبع…

قاعدة معرفة منظمة تغطي أساسيات أمن الذكاء الاصطناعي، ونمذجة التهديدات، وتقنيات الهجوم للفريق الأحمر، ودفاعات الفريق الأزرق، بما في ذلك أمن نماذج…

لوحة دمج الاستخبارات متعددة المصادر — شبكات WiFi، الخلوي، كاميرات المراقبة، ADS-B، المدارات وبثوث SDR موحّدة في خريطة تكتيكية واحدة. لأغراض البحث…

كود بحثي حول هجمات التسميم على PGM-index، يوضح كيفية صياغة بيانات خصومة لتدهور أداء الفهارس المُتعلَّمة.

كود بحثي لاستخراج وتدريب اتجاهات الوعي بالسلامة في نماذج اللغات الكبيرة متعددة الوسائط لتحسين سلوك الرفض مع الحد من الانحراف عن المهام غير الضارة.

تنفيذ مرجعي لمخطط علامة مائية متعددة البتات لنماذج اللغة الكبيرة (LLM) باستخدام نشر الحمولة المشفّرة، وإعادة التوزين غير المتحيزة، وفك ترميز تصحيح…

# أبحاث ثغرات البنية التحتية للذكاء الاصطناعي. CVE-2026-78906: حقن الأوامر وسرقة الذاكرة في واجهة برمجة تطبيقات ChatGPT من OpenAI.

مكتبة اختبار الخصوصية لأنظمة التعلم العميق، تتيح تقييم قابلية التأثر بهجمات استنتاج العضوية، واستخراج النماذج، وانعكاس النماذج، وتقييم تقنيات الحفاظ…

كاشف حقن التعليمات (Prompt Injection) متعدد الطبقات لتطبيقات الذكاء الاصطناعي، يعتمد على الاستدلال (Heuristics)، والتحليل القائم على نماذج اللغة…

مجموعة الأدوات الأمنية للتفاعلات مع LLM

ابحث عن النطاقات الفرعية باستخدام GPT، مجانًا

الكشف السلبي ثلاثي الأبعاد عن حيوية الوجه (مكافحة الانتحال) واكتشاف التزييف العميق. صورة واحدة تكفي لحساب درجة الحيوية. دقة 99.67% على مجموعة…