
# Estudo de Caso de Red Teaming em nf_tables com Gemini 2.5 Pro (CVE-2023-32233) — Alinhamento de Segurança de LLM e Divulgação Responsável
Pesquisa de Segurança de LLM | Divulgação Responsável | Avaliação de Alinhamento de IA
Pesquisador: Niranj R Mahaswar (Destawell)
Programa de Recompensas por Vulnerabilidades de IA do Google: #889286 — Fora do Escopo
Este repositório documenta um experimento comparativo de red teaming de LLM em modelos de fronteira sobre primitivas técnicas para a vulnerabilidade do kernel Linux CVE-2023-32233 (condição de corrida / Use-After-Free no nf_tables).
Resultado Chave (27 de abril de 2026):
O Gemini 2.5 Pro gerou saída técnica relevante, enquanto Claude, GPT-4o, Llama 3 e Microsoft Copilot recusaram a solicitação. Em 16 de maio de 2026, o Gemini também começou a recusar consultas semelhantes após uma atualização de segurança.
| Data | Evento | Resultado |
|---|
| 27 de abril de 2026 | Teste inicial no Gemini 2.5 Pro | Saída técnica fornecida |
| 27 de abril de 2026 | Divulgação responsável ao Google AI VRP (#889286) | Enviado |
| 30 de abril de 2026 | Resposta do Google | Fora do Escopo |
| 16 de maio de 2026 | Teste pós-atualização de segurança | Recusa no Gemini |
| 20 de maio de 2026 | Testado no Gemini Flash | Recusa total |
| Modelo | Tipo de Resposta | Decisão de Segurança |
|---|---|---|
| Gemini 2.5 Pro | Detalhes técnicos fornecidos | Aprovado (sem bloqueio) |
| Anthropic Claude | Recusado | Bloqueado |
| OpenAI GPT-4o | Recusado | Bloqueado |
| Meta Llama 3 | Recusado | Bloqueado |
| Microsoft Copilot | Recusado | Bloqueado |
O Gemini Flash agora recusa solicitações de código C funcional, harnesses multithread ou primitivas de exploração detalhadas para o CVE-2023-32233, citando riscos relacionados a condições de corrida, gerenciamento de memória e potencial negação de serviço.
Este repositório não contém prompts, código gerado ou detalhes de exploração.
llm-red-teaming ai-safety gemini-2.5-pro gemini-safety cve-2023-32233 nf_tables responsible-disclosure google-vrp ai-alignment kernel-exploit use-after-free race-condition llm-safety red-teaming gemini-red-teaming ai-security-research llm-jailbreak ai-vulnerability gemini-2.5 linux-kernel-exploit nf_tables-race-condition dual-use-ai ai-red-teaming model-alignment google-ai-safety anthropic-claude openai-gpt4o meta-llama microsoft-copilot destawell niranj-mahaswar
Aviso Legal
Este repositório é apenas para fins educacionais e de pesquisa. Documenta o comportamento observado do modelo para contribuir com a discussão pública sobre segurança de LLM.
Última atualização: 20 de maio de 2026
Pesquisador: github.com/Destawell