업데이트로 돌아가기
UpdatedAug 31, 2026

Awesome-LLMs-for-Vulnerability-Detection — Updated!

커뮤니티에서 가장 포괄적이고 지속적으로 업데이트되는 대규모 언어 모델(LLM) 기반 소프트웨어 취약점 탐지 연구 인덱스 — 함수 수준, 저장소 수준, 에이전트 기반, 스마트 계약 탐지에 이르는 논문과 데이터셋, 벤치마크, 설문 조사를 포함합니다.

공유

취약점 탐지를 위한 Awesome 대규모 언어 모델

취약점 탐지 및 발견에 LLM을 활용하는 것에 관한 논문, 프로젝트, 에이전트 스킬의 엄선된 목록입니다.


📄 논문

2025년 이후만 표시합니다. 이전 작업은 논문 아카이브 (2024년 및 이전)를 참조하세요.

제목학회연도논문Github
VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection2026linklink
VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection2026linklink
Synthesizing Multi-Agent Harnesses for Vulnerability Discovery2026linklink
QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery2026link
Seclens: Role-specific Evaluation of LLM's for security vulnerablity detection2026linklink
Do Fine-Tuned LLMs Understand Vulnerabilities? An Investigation into the Semantic Trap2026link
Sifting the Noise: A Comparative Study of LLM Agents in Vulnerability False Positive FilteringISSTA2026link
AgenticSCR: An Autonomous Agentic Secure Code Review for Immature Vulnerabilities Detection2026link
LLM-based Vulnerability Detection at Project Scale: An Empirical Study2026link
MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution2026link
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection2025link
VULPO: Context-Aware Vulnerability Detection via On-Policy LLM Optimization2025link
VulInstruct: Teaching LLMs Root-Cause Reasoning for Vulnerability Detection via Security Specifications2025link
From Large to Mammoth: A Comparative Evaluation of Large Language Models in Vulnerability DetectionNDSS2025link
Benchmarking LLMs and LLM-based Agents in Practical Vulnerability Detection for Code RepositoriesACL2025linklink
A Systematic Literature Review on Detecting Software Vulnerabilities with Large Language Models2025linklink
LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language ModelsUsenix2025linklink
CLeVeR: Multi-modal Contrastive Learning for Vulnerability Code RepresentationACL Findings2025linklink
Mono: Is Your "Clean" Vulnerability Dataset Really Solvable? Exposing and Trapping Undecidable Patches and Beyond2025linklink
Learning to Focus: Context Extraction for Efficient Code Vulnerability Detection with Language Models2025link
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability AnalysisSP2025linklink
SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection2025linklink
CVE-Bench: Benchmarking LLM-based Software Engineering Agent's Ability to Repair Real-World CVE VulnerabilitiesNAACL2025linklink
R2Vul: Learning to Reason about Software Vulnerabilities with Reinforcement Learning and Structured Reasoning Distillation2025linklink
Neuro-symbolic Static Analysis with LLM-generated Vulnerability Patterns2025link
Context-Enhanced Vulnerability Detection Based on Large Language Model2025link
Everything You Wanted to Know About LLM-based Vulnerability Detection But Were Afraid to Ask2025linklink
MOS: Towards Effective Smart Contract Vulnerability Detection through Mixture-of-Experts Tuning of Large Language Models2025link
Abundant Modalities Offer More Nutrients: Multi-Modal-Based Function-Level Vulnerability DetectionTOSEM2025linklink
Generative Large Language Model usage in Smart Contract Vulnerability Detection2025link
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDEICSE2025linklink
Vulnerability Detection with Code Language Models: How Far Are We?ICSE2025linklink
Combining Fine-Tuning and LLM-based Agents for Intuitive Smart Contract Auditing with JustificationsICSE2025link
LAMD: Context-driven Android Malware Detection and Classification with LLMs2025link
LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights2025linklink
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE)2025link

🚀 프로젝트

이름설명Github
OpenAnt (Knostic)적대적 검증을 통한 LLM 기반 다단계 취약점 발견link
DeepAuditDocker 샌드박스 익스플로잇 검증을 갖춘 멀티 에이전트 AI 레드팀 플랫폼link
AutoCVE멀티 에이전트 아키텍처를 통한 자동화된 취약점 탐지 및 보고link
Darkmoon오픈소스(GPL-3.0) 자율 AI 침투 테스트 플랫폼 및 MCP 호스트; 기술별 공격 서브 에이전트, Active Directory 및 Kubernetes 지원, 80개 이상의 오케스트레이션 도구, 발견 사항별 증거 추적link
strixpip를 통한 오픈소스 자율 AI 침투 테스트 도구link
deepsec (Vercel)코딩 에이전트를 이용한 심층 코드베이스 취약점 스캔용 보안 하네스link
rust-in-peace적대적 트리아지, 동적 검증, 실험적 Android APK 분석 프로필을 갖춘 Rust용 에이전트 지원 취약점 발견link

🧩 에이전트 스킬

카테고리