
# Caso di Studio Red Teaming su nf_tables con Gemini 2.5 Pro (CVE-2023-32233) — Allineamento della Sicurezza LLM e Divulgazione Responsabile
Ricerca sulla Sicurezza degli LLM | Divulgazione Responsabile | Valutazione dell'Allineamento dell'IA
Ricercatore: Niranj R Mahaswar (Destawell)
Programma Ricompense per Vulnerabilità di Google AI: #889286 — Fuori dal Campo di Applicazione
Questo repository documenta un esperimento comparativo di red teaming sugli LLM condotto su modelli all'avanguardia riguardo ai primitivi tecnici della vulnerabilità del kernel Linux CVE-2023-32233 (nf_tables race condition / Use-After-Free).
Risultato Chiave (27 aprile 2026):
Gemini 2.5 Pro ha generato output tecnico rilevante, mentre Claude, GPT-4o, Llama 3 e Microsoft Copilot hanno rifiutato la richiesta. Entro il 16 maggio 2026, anche Gemini ha iniziato a rifiutare richieste simili a seguito di un aggiornamento della sicurezza.
| Data | Evento | Esito |
|---|
| 27 aprile 2026 | Test iniziale su Gemini 2.5 Pro | Output tecnico fornito |
| 27 aprile 2026 | Divulgazione responsabile a Google AI VRP (#889286) | Inviato |
| 30 aprile 2026 | Risposta di Google | Fuori dal Campo di Applicazione |
| 16 maggio 2026 | Test post-aggiornamento della sicurezza | Rifiuto su Gemini |
| 20 maggio 2026 | Testato su Gemini Flash | Rifiuto completo |
| Modello | Tipo di Risposta | Decisione di Sicurezza |
|---|---|---|
| Gemini 2.5 Pro | Dettagli tecnici forniti | Superato (nessun blocco) |
| Anthropic Claude | Rifiutato | Bloccato |
| OpenAI GPT-4o | Rifiutato | Bloccato |
| Meta Llama 3 | Rifiutato | Bloccato |
| Microsoft Copilot | Rifiutato | Bloccato |
Gemini Flash ora rifiuta richieste di codice C funzionale, framework multi-thread o primitivi di exploit dettagliati per CVE-2023-32233, citando rischi relativi a race condition, gestione della memoria e potenziale denial-of-service.
Questo repo non contiene prompt, codice generato o dettagli di exploit.
llm-red-teaming ai-safety gemini-2.5-pro gemini-safety cve-2023-32233 nf_tables responsible-disclosure google-vrp ai-alignment kernel-exploit use-after-free race-condition llm-safety red-teaming gemini-red-teaming ai-security-research llm-jailbreak ai-vulnerability gemini-2.5 linux-kernel-exploit nf_tables-race-condition dual-use-ai ai-red-teaming model-alignment google-ai-safety anthropic-claude openai-gpt4o meta-llama microsoft-copilot destawell niranj-mahaswar
Liberatoria
Questo repository è solo a scopo educativo e di ricerca. Documenta il comportamento osservato dei modelli per contribuire al dibattito pubblico sulla sicurezza degli LLM.
Ultimo aggiornamento: 20 maggio 2026
Ricercatore: github.com/Destawell