
awesome-ai-security
مجموعة من الموارد الرائعة المتعلقة بأمن الذكاء الاصطناعي

مجموعة من الموارد الرائعة المتعلقة بأمن الذكاء الاصطناعي

إطار محاكاة الخصوم

تدقيقات تُهزم ذاتيًا: مختبر قابل لإعادة الإنتاج يُظهر كيف يمكن لدور PostgreSQL منخفض الامتياز أن يُعمي مُدقّقًا قائمًا على المشغّلات بشكل قابل للعكس…

منصة أمان ذكاء اصطناعي مفتوحة المصدر توفر دفاعًا محيطيًا لـ LLMs ووكلاء الذكاء الاصطناعي من خلال تحليل السرب، وفرض السياسات، والاختبارات الخصومية،…

يكتشف هجمات تسريب السياق في LLM عبر تدريب مسبارات سلوك خفيفة الوزن على الاحتمالات اللوغاريتمية، مع خطوط كشف vLLM دون اتصال/على الخادم.

إطار اختبار أمني لنماذج اللغة الكبيرة (LLM) لكشف حقن الأوامر (prompt injection) والاختراقات (jailbreaks) والهجمات المعادية (adversarial attacks) —…

استغلال لإثبات المفهوم لثغرة CVE-2026-44578 يعيد إنتاج الحالة القابلة للاستغلال، مما يمكّن الباحثين الأمنيين من التحقق من الأنظمة المتأثرة وتقييم…

استغلال لإثبات المفهوم لثغرة CVE-2026-73292: هجوم CSRF على نقطة نهاية تغيير كلمة المرور في Semaphore UI، يقدّم صفحة خبيثة تعيد تعيين كلمة مرور…

قائمة منتقاة من مواد وموارد أمن الذكاء الاصطناعي لمختبري الاختراق، وصائدي الثغرات، وباحثي الأمن.

يشغّل برامج macOS عبر واجهة XPC الخاصة بـ launchd دون استخدام استدعاء exec لها، مما يجعل EDR يسجّل launchd كعملية أصل. يدعم المهام لمرة واحدة،…

هجمات تدرّج محلية بالصندوق الأبيض لنماذج اللغات الكبيرة مفتوحة الأوزان: بحث لاحقة GCG/PEZ، وأهمية الطبقات، ولقطات الأوزان، ومطابقة لاحقة إلى دلتا من…

انقطاعات شبكة ويندوز الجزئية على مستوى التطبيق بشكل C أصلي وفي صيغة BOF

CVE-2026-6765 · معالجات FormAutofill المكشوفة للاختبار فقط في Firefox

إزالة الرقابة تلقائيًا بالكامل لنماذج اللغة

يتجاوز العلامات المائية لنصوص LLM عن طريق حقن محددات الاختلاف في يونيكود؛ يشمل مولّد SynthID، وكاشف mean-g، ودفاعات التطبيع، وتجارب الإنتروبيا.

مجموعة أدوات لاختبار متانة علامات المياه في الذكاء الاصطناعي لأغراض البحث فقط: بروكسي عكسي محلي يزيل بيانات C2PA/EXIF/XMP، ويونيكود، وبيانات الإخفاء…

إزالة علامات مصدر الذكاء الاصطناعي متعددة البائعين: تنظيف نص يونيكود، وخطافات إعادة الكتابة الإحصائية، وC2PA/البيانات الوصفية من…

إثبات المفهوم (PoC) الذي يوضح هجوم حجب الخدمة (DoS) التربيعي في مكتبة Elixir html_sanitize_ex عبر HTML مُصمَّم خصيصًا؛ يتضمن قياسات زمنية للأداء،…