
Collection organisée d'articles de recherche sur la sécurité de la génération augmentée par récupération, classée selon la taxonomie SLOT couvrant l'empoisonnement des connaissances, la manipulation de la récupération, l'exploitation du contexte et les défenses.
Version initiale : Ce dépôt recense les articles sur la sécurité des RAG selon la taxonomie SLOT issue de notre étude.
Yuming Xu 1, Mingtao Zhang 1, Zhuohan Ge 1, Haoyang Li 1, Nicole Hu 1, Yongqi Zhang 2, Zhiyuan Wen 1, Jason Chen Zhang 1, Qing Li 1, Lei Chen 2
1The Hong Kong Polytechnic University, 2The Hong Kong University of Science and Technology (Guangzhou).
@article{xu2026securing,
title={A Survey of Secure Retrieval-Augmented Generation},
author={Xu, Yuming and Zhang, Mingtao and Ge, Zhuohan and Li, Haoyang and Hu, Nicole and Zhang, Yongqi and Wen, Zhiyuan and Zhang, Jason Chen and Li, Qing and Chen, Lei},
journal={arXiv preprint arXiv:2604.08304},
year={2026}
}
Si vous souhaitez inclure votre article, suggérer des améliorations à notre étude, ou discuter de sujets connexes avec nous, n'hésitez pas à nous contacter : [email protected].
Surfaces d'attaque (S1-S4) et couches de défense qui leur correspondent (L1-L4) le long du pipeline RAG.
Vue SLOT du pipeline d'accès aux connaissances RAG. Les surfaces d'attaque (S1-S4) et les couches de défense (L1-L4) sont alignées avec les étapes du pipeline, tandis que l'Objectif (O) et la Cible (T) sont des étiquettes transversales utilisées pour comparer les attaques, les défenses et les benchmarks, c'est-à-dire, Étiquette SLOT = Surface/Couche + Objectif + Cible.
| Année | Titre | Surface/Layer | Objectif | Target | Lieu | Lien officiel |
|---|---|---|---|---|---|---|
| 2026 | Practical Poisoning Attacks against Retrieval-Augmented Generation (CorruptRAG) | S1; sec: S2 | O1 | T1 | SACMAT | Article |
| 2026 | RIPRAG: Hack a Black-box Retrieval-Augmented Generation Question-Answering System with Reinforcement Learning | S1; sec: S2 | O1 | T1 | Findings of ACL | Article |
| 2026 | Token-Level Precise Attack on RAG: Searching for the Best Alternatives to Mislead Generation | S1; sec: S2 | O1 | T1 | Findings of EACL | Article |
| 2026 | Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems | S1; sec: S2, S3 | O1 | T1 | AAAI | Article Code |
| 2025 | The Silent Saboteur: Imperceptible Adversarial Attacks against Black-Box Retrieval-Augmented Generation Systems | S1; sec: S2 | O1 | T1 | Findings of ACL | Article Code |
| 2025 | One Shot Dominance: Knowledge Poisoning Attack on Retrieval-Augmented Generation Systems (AuthChain) | S1; sec: S2 | O1 | T1 | Findings of EMNLP | Article Code |
| 2025 | The RAG Paradox: A Black-Box Attack Exploiting Unintentional Vulnerabilities in Retrieval-Augmented Generation Systems | S1; sec: S2 | O1 | T1 | Findings of EMNLP | Article |
| 2025 | PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models | S1; sec: S2 | O1 | T1 | USENIX Security | Article Code |
| 2024 | Typos that Broke the RAG's Back: Genetic Attack on RAG Pipeline by Simulating Documents in the Wild via Low-Level Perturbations (GARAG) | S1; sec: S2 | O1 | T1 | Findings of EMNLP | Article |
| 2024 | Human-Imperceptible Retrieval Poisoning Attacks in LLM-Powered Applications | S1; sec: S3 | O1 | T1 | FSE Companion | Article |
| 2024 | HijackRAG: Hijacking Attacks against Retrieval-Augmented Large Language Models | S1; sec: S2, S3 | O1 | T1 | arXiv | Article Code |