
aco-prompt-shield
Arrêtez les attaques par injection de prompt avant qu'elles n'atteignent votre LLM — zéro coût d'API, fonctionne entièrement en local, intégration en…

Arrêtez les attaques par injection de prompt avant qu'elles n'atteignent votre LLM — zéro coût d'API, fonctionne entièrement en local, intégration en…

Framework d’attaque en boîte noire qui détourne le raisonnement des systèmes de génération augmentée par récupération agentiques en injectant des…

Google Tensor Craque

Suppression entièrement automatique de la censure pour les modèles de langage

Un agent d'évaluation pour détecter la désinformation et l'empoisonnement des connaissances dans les systèmes de génération augmentée par…

Défense asymétrique contre les agents IA adverses. VeilGate évalue chaque requête entrante, redirige les agents suspects vers un environnement…

Outil de récupération de types basé sur N-gram pour binaires, récupérant les structures et les signatures de fonctions à partir de code décompilé…

Gestion automatisée du contexte multi-agents pour les tâches à long horizon dans les agents d'IA locaux

Une approche multi-architecture basée sur les graphes et alimentée par le ML pour la détection des gadgets ROP

Un ensemble complet de métriques d'équité pour les ensembles de données et les modèles d'apprentissage automatique, des explications pour ces…

Code de recherche reproduisant les expériences de jailbreak multi-tours sur les LLM (FITD, MRCJ, ActorAttack, X-Teaming) issues de l'article de…

Génération pratique de paquets adverses en black-box contre la classification du trafic chiffré, avec une surcharge minimale et une récupérabilité…

Outil de perturbation d'images adversariales qui utilise la segmentation SAM et les modèles CLIP pour contourner les classificateurs d'images…

LLM à poids ouverts et code d'entraînement/évaluation pour se défendre contre les attaques par injection de prompt, avec des benchmarks pour la…

Détection de reverse shell avec machine learning

référentiel d'évaluation pour l'évaluation comparative de red-teaming spécifique au domaine financier

Un benchmark pour évaluer les agents d'IA sur la correction de vulnérabilités de sécurité réelles.

Bibliothèque Python pour l'analyse de sécurité locale assistée par LLM avec analyse binaire Ghidra, scan de vulnérabilités C/C++ et intégration…