#1أطر هجوم التعلم الآلي العدائي وتقنيات التهرب وأدوات تقييم متانة النموذج.
موصى به من Kitploit

اختبر الموجهات (prompts) والوكلاء (agents) وأنظمة RAG. الاختراق الهجومي/اختبار الاختراق/فحص الثغرات للذكاء الاصطناعي. قارن أداء GPT وClaude وGemini…

إطار عمل مفتوح المصدر لاختبار أنظمة الذكاء الاصطناعي التوليدي هجوميًا (Red Teaming): أتمتة مطالبات الهجوم، وتقييم استجابات النماذج، وتدقيق السلوك…

Empire is a post-exploitation and adversary emulation framework that is used to aid Red Teams and Penetration Testers.

مجموعات وعناصر لإرفاقها بأحداث أو سمات MISP (مثل الجهات الفاعلة في التهديدات)

يركز معيار التحقق من أمان الذكاء الاصطناعي (AISVS) على تزويد المطورين والمهندسين المعماريين ومتخصصي الأمن بقائمة تحقق منظمة للتحقق من أمان التطبيقات…

مكتبة بايثون لكشف الشذوذ في البيانات الجدولية والسلاسل الزمنية والرسوم البيانية والنصوص والصور والبيانات الصوتية. تضم أكثر من 60 كاشفًا، وتنسيق…

ماسح أمني لملفات نماذج الذكاء الاصطناعي/التعلم الآلي. يكتشف الشيفرات الخبيثة، والأبواب الخلفية، والثغرات قبل النشر.

إطار اختبار أمني لنماذج اللغة الكبيرة (LLM) لكشف حقن الأوامر (prompt injection) والاختراقات (jailbreaks) والهجمات المعادية (adversarial attacks) —…

:cloud: :zap: Granular, Actionable Adversary Emulation for the Cloud

🐢 Open-Source Evaluation & Testing library for LLM Agents

A curated list of AI Security materials and resources for Pentesters, Bug Hunters, and Security Researchers.

مجموعة من الموارد الرائعة المتعلقة بأمن الذكاء الاصطناعي

إزالة الرقابة تلقائيًا بالكامل لنماذج اللغة

قابلية تفسير البيانات ونماذج التعلّم الآلي وشرحها

🧪 Measures memory-poisoning / prompt-injection deterministically — anchored to CVE-2026-24301 (CoSnitch), Inspect scorer, signed receipts.…

A privacy-first app that strips AI watermarks from content you own.

محرك اختبار Red-Teaming مستقل لنماذج اللغة الكبيرة (LLMs). يدير RedThread دورة حياة الأمان الكاملة: توليد هجمات خصومية، وتنفيذ تقييمات دقيقة، وتوليف…

إطار محاكاة الخصوم