Voltar às atualizações
UpdatedAug 31, 2026

Awesome-LLMs-for-Vulnerability-Detection — Updated!

O índice mais abrangente e continuamente atualizado da comunidade sobre pesquisas em Large Language Models para detecção de vulnerabilidades de software — artigos sobre detecção em nível de função, nível de repositório, agentes e contratos inteligentes, além de conjuntos de dados, benchmarks e pesquisas.

Compartilhar

Awesome Large Language Models para Detecção de Vulnerabilidades

Uma lista curada de artigos, projetos e habilidades de agentes sobre o uso de LLMs para detecção e descoberta de vulnerabilidades.


📄 Artigos

Mostrando apenas 2025 e posteriores. Para trabalhos anteriores, consulte Arquivo de Artigos (2024 e anteriores).

TítuloLocalAnoArtigoGithub
VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection2026linklink
VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection2026linklink
Synthesizing Multi-Agent Harnesses for Vulnerability Discovery2026linklink
QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery2026link
Seclens: Role-specific Evaluation of LLM's for security vulnerablity detection2026linklink
Do Fine-Tuned LLMs Understand Vulnerabilities? An Investigation into the Semantic Trap2026link
Sifting the Noise: A Comparative Study of LLM Agents in Vulnerability False Positive FilteringISSTA2026link
AgenticSCR: An Autonomous Agentic Secure Code Review for Immature Vulnerabilities Detection2026link
LLM-based Vulnerability Detection at Project Scale: An Empirical Study2026link
MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution2026link
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection2025link
VULPO: Context-Aware Vulnerability Detection via On-Policy LLM Optimization2025link
VulInstruct: Teaching LLMs Root-Cause Reasoning for Vulnerability Detection via Security Specifications2025link
From Large to Mammoth: A Comparative Evaluation of Large Language Models in Vulnerability DetectionNDSS2025link
Benchmarking LLMs and LLM-based Agents in Practical Vulnerability Detection for Code RepositoriesACL2025linklink
A Systematic Literature Review on Detecting Software Vulnerabilities with Large Language Models2025linklink
LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language ModelsUsenix2025linklink
CLeVeR: Multi-modal Contrastive Learning for Vulnerability Code RepresentationACL Findings2025linklink
Mono: Is Your "Clean" Vulnerability Dataset Really Solvable? Exposing and Trapping Undecidable Patches and Beyond2025linklink
Learning to Focus: Context Extraction for Efficient Code Vulnerability Detection with Language Models2025link
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability AnalysisSP2025linklink
SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection2025linklink
CVE-Bench: Benchmarking LLM-based Software Engineering Agent's Ability to Repair Real-World CVE VulnerabilitiesNAACL2025linklink
R2Vul: Learning to Reason about Software Vulnerabilities with Reinforcement Learning and Structured Reasoning Distillation2025linklink
Neuro-symbolic Static Analysis with LLM-generated Vulnerability Patterns2025link
Context-Enhanced Vulnerability Detection Based on Large Language Model2025link
Everything You Wanted to Know About LLM-based Vulnerability Detection But Were Afraid to Ask2025linklink
MOS: Towards Effective Smart Contract Vulnerability Detection through Mixture-of-Experts Tuning of Large Language Models2025link
Abundant Modalities Offer More Nutrients: Multi-Modal-Based Function-Level Vulnerability DetectionTOSEM2025linklink
Generative Large Language Model usage in Smart Contract Vulnerability Detection2025link
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDEICSE2025linklink
Vulnerability Detection with Code Language Models: How Far Are We?ICSE2025linklink
Combining Fine-Tuning and LLM-based Agents for Intuitive Smart Contract Auditing with JustificationsICSE2025link
LAMD: Context-driven Android Malware Detection and Classification with LLMs2025link
LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights2025linklink
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE)2025link

🚀 Projetos

NomeDescriçãoGithub
OpenAnt (Knostic)Descoberta de vulnerabilidades em múltiplos estágios com verificação adversarial baseada em LLMlink
DeepAuditPlataforma multiagente de red-team com validação de exploits em sandbox Dockerlink
AutoCVEDetecção e relatório automatizados de vulnerabilidades com arquitetura multiagentelink
DarkmoonPlataforma autônoma de pentest com IA de código aberto (GPL-3.0) e host MCP; subagentes ofensivos por tecnologia, cobertura de Active Directory e Kubernetes, mais de 80 ferramentas orquestradas, trilha de evidências por descobertalink
strixFerramenta autônoma de pentest com IA de código aberto instalável via piplink
deepsec (Vercel)Harness de segurança para varredura profunda de vulnerabilidades em bases de código com agentes de codificaçãolink

🧩 Habilidades de Agentes

NomeDescriçãoLink
codex-security (OpenAI)Varredura autônoma de vulnerabilidades em nível de repositório via agentes Codexlink
defending-code-reference-harness (Anthropic)Habilidades de referência para modelagem de ameaças, varredura, triagem e correção com Claude Codelink
security-audit-skill (Cloudflare)Habilidade de auditoria de segurança em seis fases com agentes de caça paralelos e validação adversariallink

📡 arxiv.md

Captura e atualização diária automatizada de artigos do Arxiv para palavras-chave especificadas por meio de workflows.

Agradecimentos

O workflow Updated Arxiv Papers Daily do projeto é baseado neste projeto LLM4SE. Refatorei seu código original usando a biblioteca arxiv.

Categorias