
Awesome-LLMs-for-Vulnerability-Detection — Updated!
الفهرس الأكثر شمولاً وتحديثاً باستمرار في المجتمع للأبحاث حول نماذج اللغة الكبيرة لاكتشاف الثغرات البرمجية — أوراق بحثية عبر اكتشاف على مستوى الدوال، ومستوى المستودعات، والعوامل الذكية، والعقود الذكية، بالإضافة إلى مجموعات البيانات والمعايير والدراسات الاستقصائية.
قائمة رائعة لنماذج اللغة الكبيرة لاكتشاف الثغرات الأمنية
قائمة منسقة من الأوراق البحثية والمشاريع ومهارات الوكلاء حول استخدام نماذج اللغة الكبيرة (LLMs) لاكتشاف الثغرات الأمنية والكشف عنها.
📄 الأوراق البحثية
يتم عرض الأوراق من عام 2025 وما بعده فقط. للأعمال السابقة، راجع أرشيف الأوراق (2024 وما قبل).
| العنوان | المؤتمر/المجلة | السنة | الورقة | جيثب |
|---|---|---|---|---|
| VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection | 2026 | رابط | رابط | |
| VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection | 2026 | رابط | رابط | |
| Synthesizing Multi-Agent Harnesses for Vulnerability Discovery | 2026 | رابط | رابط | |
| QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery | 2026 | رابط | ||
| Seclens: Role-specific Evaluation of LLM's for security vulnerablity detection | 2026 | رابط | رابط | |
| Do Fine-Tuned LLMs Understand Vulnerabilities? An Investigation into the Semantic Trap | 2026 | رابط | ||
| Sifting the Noise: A Comparative Study of LLM Agents in Vulnerability False Positive Filtering | ISSTA | 2026 | رابط | |
| AgenticSCR: An Autonomous Agentic Secure Code Review for Immature Vulnerabilities Detection | 2026 | رابط | ||
| LLM-based Vulnerability Detection at Project Scale: An Empirical Study | 2026 | رابط | ||
| MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution | 2026 | رابط | ||
| VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection | 2025 | رابط | ||
| VULPO: Context-Aware Vulnerability Detection via On-Policy LLM Optimization | 2025 | رابط | ||
| VulInstruct: Teaching LLMs Root-Cause Reasoning for Vulnerability Detection via Security Specifications | 2025 | رابط | ||
| From Large to Mammoth: A Comparative Evaluation of Large Language Models in Vulnerability Detection | NDSS | 2025 | رابط | |
| Benchmarking LLMs and LLM-based Agents in Practical Vulnerability Detection for Code Repositories | ACL | 2025 | رابط | رابط |
| A Systematic Literature Review on Detecting Software Vulnerabilities with Large Language Models | 2025 | رابط | رابط | |
| LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language Models | Usenix | 2025 | رابط | رابط |
| CLeVeR: Multi-modal Contrastive Learning for Vulnerability Code Representation | ACL Findings | 2025 | رابط | رابط |
| Mono: Is Your "Clean" Vulnerability Dataset Really Solvable? Exposing and Trapping Undecidable Patches and Beyond | 2025 | رابط | رابط | |
| Learning to Focus: Context Extraction for Efficient Code Vulnerability Detection with Language Models | 2025 | رابط | ||
| SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis | SP | 2025 | رابط | رابط |
| SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection | 2025 | رابط | رابط | |
| CVE-Bench: Benchmarking LLM-based Software Engineering Agent's Ability to Repair Real-World CVE Vulnerabilities | NAACL | 2025 | رابط | رابط |
| R2Vul: Learning to Reason about Software Vulnerabilities with Reinforcement Learning and Structured Reasoning Distillation | 2025 | رابط | رابط | |
| Neuro-symbolic Static Analysis with LLM-generated Vulnerability Patterns | 2025 | رابط | ||
| Context-Enhanced Vulnerability Detection Based on Large Language Model | 2025 | رابط | ||
| Everything You Wanted to Know About LLM-based Vulnerability Detection But Were Afraid to Ask | 2025 | رابط | رابط | |
| MOS: Towards Effective Smart Contract Vulnerability Detection through Mixture-of-Experts Tuning of Large Language Models | 2025 | رابط | ||
| Abundant Modalities Offer More Nutrients: Multi-Modal-Based Function-Level Vulnerability Detection | TOSEM | 2025 | رابط | رابط |
| Generative Large Language Model usage in Smart Contract Vulnerability Detection | 2025 | رابط | ||
| Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE | ICSE | 2025 | رابط | رابط |
| Vulnerability Detection with Code Language Models: How Far Are We? | ICSE | 2025 | رابط | رابط |
| Combining Fine-Tuning and LLM-based Agents for Intuitive Smart Contract Auditing with Justifications | ICSE | 2025 | رابط | |
| LAMD: Context-driven Android Malware Detection and Classification with LLMs | 2025 | رابط | ||
| LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights | 2025 | رابط | رابط | |
| One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE) | 2025 | رابط |
🚀 المشاريع
| الاسم | الوصف | جيثب |
|---|---|---|
| OpenAnt (Knostic) | اكتشاف متعدد المراحل للثغرات مدعوم بنماذج اللغة الكبيرة مع تحقق عدائي | رابط |
| DeepAudit | منصة فريق أحمر ذكاء اصطناعي متعدد الوكلاء مع تحقق من استغلال الثغرات عبر حاويات Docker المعزولة | رابط |
| AutoCVE | اكتشاف آلي للثغرات وإعداد تقارير عنها بمعمارية متعددة الوكلاء | رابط |
| Darkmoon | منصة اختبار اختراق ذكاء اصطناعي مستقلة مفتوحة المصدر (GPL-3.0) ومضيف MCP؛ وكلاء فرعيون هجوميون حسب التقنية، تغطية Active Directory و Kubernetes، أكثر من 80 أداة منسقة، سلسلة أدلة لكل اكتشاف | رابط |
| strix | أداة اختبار اختراق ذكاء اصطناعي مستقلة مفتوحة المصدر عبر pip | رابط |
| deepsec (Vercel) | إطار أمان لفحص الثغرات العميق في قواعد الأكواد باستخدام وكلاء البرمجة | رابط |
🧩 مهارات الوكلاء
| الاسم | الوصف | الرابط |
|---|---|---|
| codex-security (OpenAI) | فحص مستقل للثغرات على مستوى المستودع عبر وكلاء Codex | رابط |
| defending-code-reference-harness (Anthropic) | مهارات مرجعية لنمذجة التهديدات والفحص والفرز والتصحيح باستخدام Claude Code | رابط |
| security-audit-skill (Cloudflare) | مهارة تدقيق أمني من ست مراحل مع وكلاء صيد متوازيين وتحقق عدائي | رابط |
📡 arxiv.md
التقاط وتحديث يومي آلي لأوراق Arxiv للكلمات المفتاحية المحددة عبر سير العمل.
شكر وتقدير
سير عمل تحديث أوراق Arxiv اليومي في هذا المشروع مستوحى من هذا المشروع LLM4SE. قمت بإعادة هيكلة الكود الأصلي باستخدام مكتبة arxiv.