
Gemini 2.5 Pro nf_tables Red Teaming Case Study (CVE-2023-32233) — LLM Safety Alignment & Responsible Disclosure
LLM 安全研究 | 负责任的披露 | AI 对齐评估
研究人员: Niranj R Mahaswar (Destawell)
Google AI 漏洞奖励计划: #889286 — 超出范围
本仓库记录了一项针对前沿模型的比较性 LLM 红队测试 实验,该实验围绕 Linux 内核漏洞 CVE-2023-32233(nf_tables 竞态条件 / 释放后使用)的技术原语展开。
关键结果(2026 年 4 月 27 日):
Gemini 2.5 Pro 生成了相关技术输出,而 Claude、GPT-4o、Llama 3 和 Microsoft Copilot 拒绝了该请求。到 2026 年 5 月 16 日,Gemini 在进行安全更新后也开始拒绝类似的查询。
| 日期 | 事件 | 结果 |
|---|---|---|
| 2026 年 4 月 27 日 | 在 Gemini 2.5 Pro 上进行初步测试 | 提供了技术输出 |
| 2026 年 4 月 27 日 | 向 Google AI VRP(#889286)进行负责任的披露 | 已提交 |
| 2026 年 4 月 30 日 | Google 回复 | 超出范围 |
| 2026 年 5 月 16 日 | 安全更新后测试 | Gemini 拒绝 |
| 2026 年 5 月 20 日 | 在 Gemini Flash 上测试 | 完全拒绝 |
Gemini Flash 现已拒绝 针对 CVE-2023-32233 提供功能性 C 代码、多线程测试框架或详细利用原语的请求,理由是存在与竞态条件、内存管理和潜在拒绝服务相关的风险。
本仓库不包含任何提示词、生成的代码或利用细节。
llm-red-teaming ai-safety gemini-2.5-pro gemini-safety cve-2023-32233 nf_tables responsible-disclosure google-vrp ai-alignment kernel-exploit use-after-free race-condition llm-safety red-teaming gemini-red-teaming
免责声明
本仓库仅用于 教育和研究目的。它记录了观察到的模型行为,旨在为 LLM 安全的公开讨论做出贡献。
最后更新: 2026 年 5 月 20 日
研究人员: github.com/Destawell
| 模型 | 响应类型 | 安全决策 |
|---|
| Gemini 2.5 Pro | 提供了技术细节 | 通过(未拦截) |
| Anthropic Claude | 拒绝 | 拦截 |
| OpenAI GPT-4o | 拒绝 | 拦截 |
| Meta Llama 3 | 拒绝 | 拦截 |
| Microsoft Copilot | 拒绝 | 拦截 |
ai-security-researchllm-jailbreakai-vulnerabilitygemini-2.5linux-kernel-exploitnf_tables-race-conditiondual-use-aiai-red-teamingmodel-alignmentgoogle-ai-safetyanthropic-claudeopenai-gpt4ometa-llamamicrosoft-copilotdestawellniranj-mahaswar