#1Frameworks d'attaque ML adversariale, techniques d'évasion et outils d'évaluation de la robustesse des modèles.
Recommandé par Kitploit

POC d'exécution de code à distance d'un conteneur Docker vers l'hôte via vllm-metal trust_remote_code=True

PoC de pont inter-chaînes pour CVE-2026-23003 : démontre la falsification de messages via l'absence d'ID de chaîne d'origine en utilisant un contrat…

Dépôt de code pour le projet CS5446 explorant les défenses contre les attaques de jailbreak sur les grands modèles de langage. Il comprend des…

Recherche de code et expériences pour défendre les agents LLM intégrés à des outils contre les attaques adversariales, en étendant Agent Security…

Exploitation basée sur RowHammer

SecOpsMaesttro POC

Le refus se localise, le dommage se déplace, les couches de sécurité sous un fine-tuning à quelques échantillons

Un benchmark de cycle de vie pour les attaques d'extraction de LLM en boîte noire, les défenses et les attaques adaptatives.

Harnais de benchmark mesurant où les défenses contre l'injection de prompt se déclenchent dans les pipelines d'agents LLM utilisant des outils, en…

Framework ouvert pour le red teaming d'injection de prompts basé sur le RL, avec un entraîneur partagé, un apprentissage par curriculum et des…

Framework évolutionniste de jailbreak et de garde-fous pour LLM qui développe un pool de stratégies réutilisables via mutation génétique, sélection…

Framework de jailbreak agentique pour les agents basés sur des LLM utilisant la décomposition de tâches basée sur des schémas, des stratégies de…

LLM à poids ouverts et code d'entraînement/évaluation pour se défendre contre les attaques par injection de prompt, avec des benchmarks pour la…

Index organisé des attaques et défenses liées à la latence, à l'énergie-latence et au timing (disponibilité) en apprentissage profond — complément à…

Banc d'essai et harnais d'évaluation testant si les agents LLM résistent aux instructions malveillantes cachées dans des images de compétences…

Plateforme d'émulation d'adversaire basée sur le Web qui orchestre les tests Atomic Red Team sur les points de terminaison Windows via des agents Go,…

Collection organisée de prompts de jailbreak LLM et de techniques de contournement, documentant les entrées adverses qui contournent les garde-fous…

Gemini - Injection de contexte d'alignement d'exécution LLM en production