
prompt_injection
Harnais de benchmark mesurant où les défenses contre l'injection de prompt se déclenchent dans les pipelines d'agents LLM utilisant des outils, en…

Harnais de benchmark mesurant où les défenses contre l'injection de prompt se déclenchent dans les pipelines d'agents LLM utilisant des outils, en…

Un décompilateur de pickling Python et un analyseur statique

Analyseur de code statique basé sur l'AST avec cartographie relationnelle agentique alimentée par LLM pour découvrir les chemins RCE Python et les…

Open source de détection de trafic invalide basée sur l'entropie et filtrage pré-enchère.

Détection avancée des scans de ports, des attaques DoS et des malwares à l'aide de techniques de Machine Learning

Benchmark suite and code for detecting AI alignment failures, with 44 benchmarks across ten failure types and a zero-shot RLCD detector evaluated on…

Plateforme open-source de renseignement sur les menaces pour l'analyse de logiciels malveillants et d'observables. Enrichit les IP, domaines, URL et…

Une bibliothèque Python pour la prévision conviviale et la détection d'anomalies sur les séries temporelles.

The AI that really does things. Any OS. Any Platform. The lobster way. 🦞

Framework ouvert pour le red teaming d'injection de prompts basé sur le RL, avec un entraîneur partagé, un apprentissage par curriculum et des…

Banc d'essai et harnais d'évaluation testant si les agents LLM résistent aux instructions malveillantes cachées dans des images de compétences…

Un outil d'apprentissage automatique qui classe les chaînes de caractères en fonction de leur pertinence pour l'analyse de logiciels malveillants.

Une base de connaissances structurée couvrant les fondamentaux de la sécurité de l'IA, la modélisation des menaces, les techniques offensives de red…

Next-generation JavaScript identifier recovery with LLMs.

Un moteur de red-teaming autonome pour les LLM. RedThread gère l'ensemble du cycle de vie de la sécurité : génération d'attaques adversariales,…

Implémentation de recherche pour l'atténuation des injections de prompt adaptatives via la distillation on-policy, avec des recettes d'entraînement…

Un paquet pour capturer et analyser les données de flux réseau et les données intra-flux, pour la recherche réseau, la criminalistique et la…

Un package open source pour l'attaque adverse textuelle.