
agentic-dm-gateway
Plan de contrôle de sécurité pour agents LLM : listes d'autorisation, interrupteur d'arrêt d'urgence du propriétaire, sessions PIN, limites de débit,…

Plan de contrôle de sécurité pour agents LLM : listes d'autorisation, interrupteur d'arrêt d'urgence du propriétaire, sessions PIN, limites de débit,…

Détecte les attaques de fuite de contexte des LLM en entraînant des sondes de comportement légères sur les log-probabilités, avec des pipelines de…

Un scanner de sécurité statique + runtime pour les serveurs MCP (Model Context Protocol)

FastGPT — outil d'audit de chaîne d'évasion de sandbox Python (lié à CVE-2026-32128, chaîne d'inspection v4.14.8)

PoC pour CVE-2025-62593 : RCE non authentifiée dans Ray (CISA KEV). Python utilisant uniquement la bibliothèque standard.

Laboratoire de recherche en engagement défensif et en renseignement sur les menaces. Convertit les e-mails d'arnaque entrants en IOC exploitables…

Une liste organisée de ressources et de documents sur la sécurité de l'IA pour les pentesters, les chasseurs de bugs et les chercheurs en sécurité.

Étude de la CVE-2018-6341 dans React, démontrant la détection de vulnérabilités assistée par IA, l'analyse des causes profondes et les…

Reconnaissance en direct et audit de posture pour l'infrastructure des agents IA : analyse les configurations MCP, les journaux de session et les API…

Attaques locales par gradient en boîte blanche pour les LLM à poids ouverts : recherche de suffixes GCG/PEZ, saillance des couches, instantanés de…

Contourne les filigranes de texte des LLM en injectant des sélecteurs de variantes Unicode ; inclut le générateur SynthID, le détecteur mean-g, les…

Boîte à outils de robustesse des filigranes IA à usage exclusivement de recherche : un proxy inverse local supprime C2PA/EXIF/XMP, Unicode, la…

CVE-2026-73678 — MindsDB Minds Platform : RCE non authentifié via scratchpad exec (CVSS 10.0). Vérifié de bout en bout avec un vrai LLM.

OpenMed < 1.5.2 RCE non authentifié via le chargement du modèle de filtre de confidentialité PII et trust_remote_code=True

Contraste local auto-référencé pour la détection d'empoisonnement des connaissances dans la génération augmentée par récupération

Supprimer les marques de provenance IA multi-fournisseurs : hygiène du texte Unicode, hooks de réécriture statistique et métadonnées C2PA depuis…

Writeups, walkthroughs et notes techniques de cybersécurité par Nanashi Bx2.

Une collection organisée de ressources pour apprendre et mener des recherches sur les attaques par injection de prompts LLM, les défenses et la…