
OpenAttack
Un package open source pour l'attaque adverse textuelle.

Un package open source pour l'attaque adverse textuelle.

Code de recherche pour HARDE, un harnais d'agent qui sonde et optimise de manière adaptative les composants pour la détection des risques à…

AI / LLM Red Team Field Manual & Guide du Consultant

Defense framework that keeps audio-language models frozen and adds a mid-layer risk gate with late-layer safety adapters to block audio jailbreaks at…

Pipeline de recherche pour la détection de signaux latents d'exposition aux injections de prompts indirectes dans les LLM agentiques via le sondage…

Plateforme d'analyse de malwares multi-format combinant un sandbox Windows furtif Ring-3, des analyseurs statiques PE/PDF, la récupération de clés de…

Moteur OCR open source avec modèles de réseaux neuronaux LSTM pour extraire du texte à partir d'images et de documents numérisés dans plus de 100…

GyoiThon est un outil de test d'intrusion en pleine croissance utilisant l'apprentissage automatique.

prend des shellcode bad-bytes et les bannit, renvoyant du shellcode nettoyé avec des fonctionnalités préservées

Intégrer plusieurs messages secrets dans les choix de jetons de chat LLM à l'aide de codeurs stéganographiques arithmétiques/Discop, avec décodage…

Un agent d'évaluation pour détecter la désinformation et l'empoisonnement des connaissances dans les systèmes de génération augmentée par…

Un agent d'audit d'alignement capable d'explorer rapidement des hypothèses d'alignement

Framework d'analyse statique Android basé sur C pour la décompilation, la détection de secrets, la découverte d'endpoints, l'analyse des permissions…

Le refus se localise, le dommage se déplace, les couches de sécurité sous un fine-tuning à quelques échantillons

Benchmarking des détections d'injection de prompt pour les agents web.

Rejeu d'événements de sécurité

Un benchmark de cycle de vie pour les attaques d'extraction de LLM en boîte noire, les défenses et les attaques adaptatives.

Attribution contextuelle causale et défense de moniteur LLM basée sur des règles contre l’injection indirecte de prompts dans les agents LLM,…