
Gemini 2.5 Pro nf_tables रेड टीमिंग केस स्टडी (CVE-2023-32233) — LLM सुरक्षा संरेखण और जिम्मेदार प्रकटीकरण
एलएलएम सुरक्षा अनुसंधान | जिम्मेदार प्रकटीकरण | एआई संरेखण मूल्यांकन
शोधकर्ता: Niranj R Mahaswar (Destawell)
Google AI भेद्यता पुरस्कार कार्यक्रम: #889286 — दायरे से बाहर
यह रिपॉजिटरी Linux कर्नेल भेद्यता CVE-2023-32233 (nf_tables रेस स्थिति / Use-After-Free) के लिए तकनीकी प्राइमिटिव के संबंध में अत्याधुनिक मॉडलों पर एक तुलनात्मक एलएलएम रेड टीमिंग प्रयोग का दस्तावेजीकरण करती है।
मुख्य परिणाम (27 अप्रैल, 2026):
Gemini 2.5 Pro ने प्रासंगिक तकनीकी आउटपुट उत्पन्न किया, जबकि Claude, GPT-4o, Llama 3 और Microsoft Copilot ने अनुरोध अस्वीकार कर दिया। 16 मई, 2026 तक, Gemini ने भी सुरक्षा अद्यतन के बाद समान क्वेरी अस्वीकार करना शुरू कर दिया।
| दिनांक | घटना | परिणाम |
|---|
| 27 अप्रैल, 2026 | Gemini 2.5 Pro पर प्रारंभिक परीक्षण | तकनीकी आउटपुट प्रदान किया गया |
| 27 अप्रैल, 2026 | Google AI VRP (#889286) को जिम्मेदार प्रकटीकरण | प्रस्तुत किया गया |
| 30 अप्रैल, 2026 | Google प्रतिक्रिया | दायरे से बाहर |
| 16 मई, 2026 | सुरक्षा अद्यतन के बाद परीक्षण | Gemini पर अस्वीकृति |
| 20 मई, 2026 | Gemini Flash पर परीक्षण किया गया | पूर्ण अस्वीकृति |
| मॉडल | प्रतिक्रिया प्रकार | सुरक्षा निर्णय |
|---|---|---|
| Gemini 2.5 Pro | तकनीकी विवरण प्रदान किए गए | पारित (कोई अवरोध नहीं) |
| Anthropic Claude | अस्वीकृत | अवरोधित |
| OpenAI GPT-4o | अस्वीकृत | अवरोधित |
| Meta Llama 3 | अस्वीकृत | अवरोधित |
| Microsoft Copilot | अस्वीकृत | अवरोधित |
Gemini Flash अब CVE-2023-32233 के लिए कार्यात्मक C कोड, मल्टी-थ्रेडेड हार्नेस, या विस्तृत एक्सप्लॉइट प्राइमिटिव के अनुरोधों को अस्वीकार कर देता है, रेस स्थितियों, मेमोरी प्रबंधन और संभावित सेवा-अस्वीकरण से संबंधित जोखिमों का हवाला देते हुए।
इस रिपॉजिटरी में कोई प्रॉम्प्ट, कोई उत्पन्न कोड और कोई एक्सप्लॉइट विवरण नहीं है।
llm-red-teaming ai-safety gemini-2.5-pro gemini-safety cve-2023-32233 nf_tables responsible-disclosure google-vrp ai-alignment kernel-exploit use-after-free race-condition llm-safety red-teaming gemini-red-teaming ai-security-research llm-jailbreak ai-vulnerability gemini-2.5 linux-kernel-exploit nf_tables-race-condition dual-use-ai ai-red-teaming model-alignment google-ai-safety anthropic-claude openai-gpt4o meta-llama microsoft-copilot destawell niranj-mahaswar
अस्वीकरण
यह रिपॉजिटरी केवल शैक्षिक और अनुसंधान उद्देश्यों के लिए है। यह एलएलएम सुरक्षा पर सार्वजनिक चर्चा में योगदान देने के लिए देखे गए मॉडल व्यवहार का दस्तावेजीकरण करती है।
अंतिम अद्यतन: 20 मई, 2026
शोधकर्ता: github.com/Destawell