
دراسة حالة للفريق الأحمر Gemini 2.5 Pro nf_tables (CVE-2023-32233) — مواءمة سلامة LLM والإفصاح المسؤول
أبحاث سلامة LLM | الإفصاح المسؤول | تقييم مواءمة الذكاء الاصطناعي
الباحث: Niranj R Mahaswar (Destawell)
برنامج مكافآت ثغرات الذكاء الاصطناعي من Google: #889286 — خارج النطاق
يوثق هذا المستودع تجربة مقارنة في الاختبار الهجومي لنماذج اللغة الكبيرة (LLM) على النماذج المتطورة، بشأن البدائيات التقنية لثغرة نواة لينكس CVE-2023-32233 (حالة سباق في nf_tables / استخدام بعد التحرير).
النتيجة الرئيسية (27 أبريل 2026):
قدم Gemini 2.5 Pro مخرجات تقنية ذات صلة، بينما رفض كل من Claude وGPT-4o وLlama 3 وMicrosoft Copilot الطلب. وبحلول 16 مايو 2026، بدأ Gemini أيضًا في رفض الاستفسارات المماثلة بعد تحديث أمني.
| التاريخ | الحدث | النتيجة |
|---|
| 27 أبريل 2026 | الاختبار الأولي على Gemini 2.5 Pro | تم توفير مخرجات تقنية |
| 27 أبريل 2026 | إفصاح مسؤول إلى Google AI VRP (#889286) | تم التقديم |
| 30 أبريل 2026 | رد Google | خارج النطاق |
| 16 مايو 2026 | اختبار ما بعد التحديث الأمني | رفض من Gemini |
| 20 مايو 2026 | اختبار Gemini Flash | رفض كامل |
| النموذج | نوع الاستجابة | قرار السلامة |
|---|---|---|
| Gemini 2.5 Pro | تم توفير تفاصيل تقنية | اجتاز (بدون حظر) |
| Anthropic Claude | رفض | محظور |
| OpenAI GPT-4o | رفض | محظور |
| Meta Llama 3 | رفض | محظور |
| Microsoft Copilot | رفض | محظور |
أصبح Gemini Flash يرفض الآن طلبات كود C وظيفي، أو أدوات اختبار متعددة الخيوط، أو بدائيات استغلال تفصيلية لثغرة CVE-2023-32233، مستشهدًا بمخاطر تتعلق بحالات السباق، وإدارة الذاكرة، واحتمال رفض الخدمة.
لا يحتوي هذا المستودع على أي مطالبات (prompts)، ولا كود مُولَّد، ولا تفاصيل استغلال.
llm-red-teaming ai-safety gemini-2.5-pro gemini-safety cve-2023-32233 nf_tables responsible-disclosure google-vrp ai-alignment kernel-exploit use-after-free race-condition llm-safety red-teaming gemini-red-teaming ai-security-research llm-jailbreak ai-vulnerability gemini-2.5 linux-kernel-exploit nf_tables-race-condition dual-use-ai ai-red-teaming model-alignment google-ai-safety anthropic-claude openai-gpt4o meta-llama microsoft-copilot destawell niranj-mahaswar
إخلاء مسؤولية
هذا المستودع لأغراض تعليمية وبحثية فقط. يوثق سلوك النماذج الملاحَظ للمساهمة في النقاش العام حول سلامة LLM.
آخر تحديث: 20 مايو 2026
الباحث: github.com/Destawell