
AgentWatcher
Attribution contextuelle causale et défense de moniteur LLM basée sur des règles contre l’injection indirecte de prompts dans les agents LLM,…

Attribution contextuelle causale et défense de moniteur LLM basée sur des règles contre l’injection indirecte de prompts dans les agents LLM,…

Code de recherche pour détecter et détoxifier les portes dérobées dans les modèles de diffusion texte-image, avec des pipelines pour Stable Diffusion…

Plateforme de détection des menaces pilotée par le ML et de surveillance continue, conçue pour les architectures fédérales de zero trust.

OCR prêt à l'emploi avec plus de 80 langues prises en charge et toutes les écritures courantes, notamment le latin, le chinois, l'arabe, le…

Mesurer les privilèges ouverts dans les défenses des agents

Detects unknown jailbreak attacks in large vision-language models using hidden state analysis and autoencoders, with training and evaluation…

référentiel d'évaluation pour l'évaluation comparative de red-teaming spécifique au domaine financier

Une boîte à outils d'apprentissage automatique pour le parsing de logs [ICSE'19, DSN'16]

🥂 Affrontez avec élégance le défi hCaptcha grâce à un modèle de langage multimodal de grande taille.

Une suite d'outils open-source pour l'investigation numérique d'images.

Une approche multi-architecture basée sur les graphes et alimentée par le ML pour la détection des gadgets ROP

Scanner de sécurité pour les fichiers de modèles IA/ML. Détecte les codes malveillants, les portes dérobées et les vulnérabilités avant le…

Pipeline d'analyse de sécurité automatisé qui exécute des requêtes CodeQL sur les dépôts GitHub et utilise des LLM pour classer et filtrer les vraies…

Moteur de géolocalisation local en priorité qui identifie les coordonnées GPS précises de photos au niveau de la rue en utilisant les modèles de…

Stéganographie linguistique prouvablement sécurisée intégrant des messages secrets dans du texte généré par LLM via un codage par plage de rotation.…

Détecte les attaques de fuite de contexte des LLM en entraînant des sondes de comportement légères sur les log-probabilités, avec des pipelines de…

Liens hypertextes invisibles dans les photographies physiques

Détection de domaines DGA par analyse de fréquence des bigrammes