
AIF360
Un ensemble complet de métriques d'équité pour les ensembles de données et les modèles d'apprentissage automatique, des explications pour ces…

Un ensemble complet de métriques d'équité pour les ensembles de données et les modèles d'apprentissage automatique, des explications pour ces…

Hook en mode noyau qui intercepte, déchiffre et neutralise le trafic de rapport BEDaisy-vers-service afin de supprimer la détection anti-triche sur…

Hardware Breakpoint (DR0-DR7) based patch-less user-mode hooking & telemetry instrumentation engine (AMSI, WLDP & ETW PoC).

Détecte les attaques de fuite de contexte des LLM en entraînant des sondes de comportement légères sur les log-probabilités, avec des pipelines de…

Self-Defeating Audits: laboratoire reproductible montrant un rôle PostgreSQL à faibles privilèges aveuglant de manière réversible un auditeur basé…

Lance des programmes macOS via l'interface XPC privée de launchd sans passer par exec, ce qui amène l'EDR à enregistrer launchd comme parent. Prend…

Une liste organisée de ressources et de documents sur la sécurité de l'IA pour les pentesters, les chasseurs de bugs et les chercheurs en sécurité.

Application-scoped Windows network brownouts in native C and BOF form

Local white-box gradient attacks for open-weight LLMs: GCG/PEZ suffix search, layer saliency, weight snapshots, and rank-1 suffix-to-delta fitting…

Evades LLM text watermarks by injecting Unicode variation selectors; includes the SynthID generator, mean-g detector, normalization defenses, and…

Boîte à outils de robustesse des filigranes IA à usage exclusivement de recherche : un proxy inverse local supprime C2PA/EXIF/XMP, Unicode, la…

Différentes méthodes pour détecter un environnement virtualisé ou un débogage potentiel

Self-referenced local contrast for knowledge-poison detection in retrieval-augmented generation

Une application axée sur la confidentialité qui supprime les filigranes IA du contenu que vous possédez.

Une collection organisée de ressources pour apprendre et mener des recherches sur les attaques par injection de prompts LLM, les défenses et la…

Detection-aware BloodHound attack-path scoring - the quietest route to your objective, calibrated across five detection tiers…

Dépôt Ghostsplice : Preuve de concept pour l'attaque de fragmentation de confiance inter-canaux

Un outil de déception basé sur les polices de caractères pour le red teaming, la recherche en sécurité, et tout le reste.