Torna agli aggiornamenti
UpdatedAug 31, 2026

Awesome-LLMs-for-Vulnerability-Detection — Updated!

L'indice più completo e costantemente aggiornato della community sulla ricerca relativa ai Large Language Models per il rilevamento delle vulnerabilità software — articoli su rilevamento a livello di funzione, a livello di repository, agentico e di smart contract, oltre a dataset, benchmark e survey.

Condividi

Awesome Large Language Models per il Rilevamento delle Vulnerabilità

Una lista curata di articoli, progetti e competenze degli agenti sull'uso degli LLM per il rilevamento e la scoperta delle vulnerabilità.


📄 Articoli

Vengono mostrati solo gli articoli del 2025 e successivi. Per i lavori precedenti, consulta Archivio Articoli (2024 e precedenti).

TitoloSedeAnnoArticoloGithub
VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection2026linklink
VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection2026linklink
Synthesizing Multi-Agent Harnesses for Vulnerability Discovery2026linklink
QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery2026link
Seclens: Role-specific Evaluation of LLM's for security vulnerablity detection2026linklink
Do Fine-Tuned LLMs Understand Vulnerabilities? An Investigation into the Semantic Trap2026link
Sifting the Noise: A Comparative Study of LLM Agents in Vulnerability False Positive FilteringISSTA2026link
AgenticSCR: An Autonomous Agentic Secure Code Review for Immature Vulnerabilities Detection2026link
LLM-based Vulnerability Detection at Project Scale: An Empirical Study2026link
MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution2026link
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection2025link
VULPO: Context-Aware Vulnerability Detection via On-Policy LLM Optimization2025link
VulInstruct: Teaching LLMs Root-Cause Reasoning for Vulnerability Detection via Security Specifications2025link
From Large to Mammoth: A Comparative Evaluation of Large Language Models in Vulnerability DetectionNDSS2025link
Benchmarking LLMs and LLM-based Agents in Practical Vulnerability Detection for Code RepositoriesACL2025linklink
A Systematic Literature Review on Detecting Software Vulnerabilities with Large Language Models2025linklink
LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language ModelsUsenix2025linklink
CLeVeR: Multi-modal Contrastive Learning for Vulnerability Code RepresentationACL Findings2025linklink
Mono: Is Your "Clean" Vulnerability Dataset Really Solvable? Exposing and Trapping Undecidable Patches and Beyond2025linklink
Learning to Focus: Context Extraction for Efficient Code Vulnerability Detection with Language Models2025link
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability AnalysisSP2025linklink
SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection2025linklink
CVE-Bench: Benchmarking LLM-based Software Engineering Agent's Ability to Repair Real-World CVE VulnerabilitiesNAACL2025linklink
R2Vul: Learning to Reason about Software Vulnerabilities with Reinforcement Learning and Structured Reasoning Distillation2025linklink
Neuro-symbolic Static Analysis with LLM-generated Vulnerability Patterns2025link
Context-Enhanced Vulnerability Detection Based on Large Language Model2025link
Everything You Wanted to Know About LLM-based Vulnerability Detection But Were Afraid to Ask2025linklink
MOS: Towards Effective Smart Contract Vulnerability Detection through Mixture-of-Experts Tuning of Large Language Models2025link
Abundant Modalities Offer More Nutrients: Multi-Modal-Based Function-Level Vulnerability DetectionTOSEM2025linklink
Generative Large Language Model usage in Smart Contract Vulnerability Detection2025link
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDEICSE2025linklink
Vulnerability Detection with Code Language Models: How Far Are We?ICSE2025linklink
Combining Fine-Tuning and LLM-based Agents for Intuitive Smart Contract Auditing with JustificationsICSE2025link
LAMD: Context-driven Android Malware Detection and Classification with LLMs2025link
LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights2025linklink
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE)2025link

🚀 Progetti

NomeDescrizioneGithub
OpenAnt (Knostic)Scoperta di vulnerabilità multi-fase basata su LLM con verifica avversarialink
DeepAuditPiattaforma multi-agente di red team AI con validazione degli exploit tramite sandbox Dockerlink
AutoCVERilevamento e segnalazione automatizzata delle vulnerabilità con architettura multi-agentelink
DarkmoonPiattaforma open-source (GPL-3.0) autonoma di pentest AI e host MCP; sotto-agenti offensivi per tecnologia, copertura di Active Directory e Kubernetes, oltre 80 strumenti orchestrati, traccia delle evidenze per ogni scopertalink
strixStrumento open-source autonomo di penetration testing AI installabile tramite piplink
deepsec (Vercel)Struttura di sicurezza per la scansione approfondita delle vulnerabilità del codebase con agenti di codificalink

🧩 Competenze degli Agenti

NomeDescrizioneLink
codex-security (OpenAI)Scansione autonoma delle vulnerabilità a livello di repository tramite agenti Codexlink
defending-code-reference-harness (Anthropic)Competenze di riferimento per threat modeling, scansione, triage e correzione con Claude Codelink
security-audit-skill (Cloudflare)Competenza di audit di sicurezza in sei fasi con agenti di ricerca paralleli e validazione avversarialink

📡 arxiv.md

Acquisizione e aggiornamento automatico giornaliero degli articoli Arxiv per parole chiave specifiche tramite workflow.

Ringraziamenti

Il workflow Updated Arxiv Papers Daily del progetto si basa su questo progetto LLM4SE. Ho rifattorizzato il suo codice originale utilizzando la libreria arxiv.

Categorie