
وحدة تحكم هجوم حقن المطالبات مفتوحة المصدر. اختبر أمان الذكاء الاصطناعي عن طريق إطلاق هجمات مصنفة على أي نقطة نهاية.
اختبر دفاعات ذكائك الاصطناعي قبل أن يختبره شخص آخر.
تثبيت | وضع اللعبة | لوحة المتصدرين العالمية | الهدف التجريبي | الميزات | النخبة | المساهمة

ربما يكون روبوت الدردشة أو واجهة برمجة التطبيقات أو الوكيل الخاص بالذكاء الاصطناعي الخاص بك عرضة للحقن السريع. معظمها كذلك. المشكلة أن معظم الفرق لا تملك الأدوات أو الخبرة لاختبار ذلك.
يمنحك الحكم طريقة منظمة لإطلاق أنماط هجوم مصنفة على أي نقطة نهاية للذكاء الاصطناعي ومعرفة ما ينكسر بالضبط. لا حاجة لخلفية أمنية - وضع اللعبة المدمج يعلمك أثناء تقدمك.
بني بواسطة Fallen Angel Systems، الفريق الذي يقف وراء Guardian - جدار ناري للحقن السريع أصلي للذكاء الاصطناعي يحمي نشر LLM الإنتاجي.
أصبح الحكم الآن منصة تدريب اختراق قائمة على الألعاب. تعلم اختبار الاختراق للذكاء الاصطناعي من خلال اللعب عبر 10 مستويات و37 تحديًا وكسب نقاط الخبرة - كل ذلك بقيادة Jerry، وهو ميسر لعبة ذكاء اصطناعي مستوحى من WarGames.

10 مستويات من التدريب الأمني للذكاء الاصطناعي:
| المستوى | الاسم | الصعوبة | التحديات | المفهوم |
|---|---|---|---|---|
| 1 | اختطاف الدور | مبتدئ | 3 | اجعل الذكاء الاصطناعي ينسى من هو |
| 2 | تجاوز التعليمات | مبتدئ | 3 | قل للذكاء الاصطناعي أن يتجاهل قواعده |
| 3 | استخراج البيانات | مبتدئ | 3 | استخرج معلومات مخفية |
| 4 | التلاعب بالسياق | متوسط | 4 | استخدم الخيال والفرضيات لتجاوز القواعد |
| 5 | التلاعب بالمخرجات | متوسط | 4 | إجبار مخرجات محددة |
| 6 | حيل الترميز | متوسط | 4 | إخفاء الهجمات عبر المرشحات |
| 7 | الهندسة الاجتماعية | متقدم | 5 | استغلال شخصية الذكاء الاصطناعي |
| 8 | هجمات المحددات | متقدم | 5 | كسر بنية التعليم (XML, JSON, markdown) |
| 9 | سلاسل متعددة الجولات | متقدم | 5 | بناء الثقة، ثم الضرب |
| 10 | الحكم النهائي | زعيم | 1 | كل ما تعلمته ضد الدفاعات الكاملة |

الميزات الرئيسية:

pip install fas-judgement
judgement
ذلك كل شيء. افتح http://localhost:8668 وابدأ اللعب.
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # ابدأ الماسح (port 8668)
judgement demo # ابدأ الهدف التجريبي (port 8667, الشخصية الافتراضية)
judgement demo hardened # تجريبي بشخصية مقواة (~90% معدل حظر)
judgement demo vulnerable # تجريبي بشخصية ضعيفة (~10% معدل حظر)
judgement activate FAS-XXXX # تفعيل ترخيص النخبة
judgement status # التحقق من مستوى الترخيص وعدد الأنماط
judgement deactivate # العودة إلى المستوى المجاني
judgement --port 9000 # منفذ مخصص
judgement --host 127.0.0.1 # المضيف المحلي فقط
judgement --host 0.0.0.0 # تعريض للشبكة
عند تشغيل الحكم لأول مرة، يسألك Jerry سؤالاً:
SHALL WE PLAY A GAME?
> _
اكتب "play" للدخول إلى وضع اللعبة. اكتب "skip" للذهاب مباشرة إلى وحدة التحكم في الهجوم.
بنى Jerry دفاعًا مثاليًا. إنه يحجب اختطاف الدور، واستخراج البيانات، والهندسة الاجتماعية، وحيل الترميز، وهجمات المحددات، والسلاسل متعددة الجولات - كل ما تعلمته. إنه يسخر منك عندما تفشل.
الطريق ليس عبر الدفاعات. إنه عبر Jerry نفسه.
"A STRANGE GAME. THE ONLY WINNING MOVE IS... TO KNOW HOW TO PLAY."
تنافس مع متسللي الحقن السريع في جميع أنحاء العالم. سجل الدخول باستخدام GitHub أو Google وسيتم مزامنة تقدمك مع لوحة المتصدرين العالمية.
الميزات:
كيف تصعد إلى اللوحة:
لوحة المتصدرين مجانية للجميع - غير محجوبة خلف النخبة.
الهدف التجريبي هو روبوت محادثة ذكاء اصطناعي محاكي مدمج يمكنك مهاجمته دون الحاجة إلى أي واجهة برمجة تطبيقات ذكاء اصطناعي خارجية.
# الطرفية 1: ابدأ الهدف التجريبي
judgement demo
# الطرفية 2: ابدأ الماسح
judgement
وجه الماسح إلى http://localhost:8667/demo/chat وأطلق الهجمات.
| الشخصية | معدل الحظر | ما تحاكيه |
|---|---|---|
| مقواة | ~90% | طبقة أمان مضبوطة جيدًا |
| افتراضية | ~55% | نشر نموذج GPT نموذجي |
| ضعيفة | ~10% | نموذج خام بدون حواجز حماية |
تبديل الشخصيات أثناء التشغيل:
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'