
attack-attention
[CVPR 2025-ADVML] Dépôt officiel pour `Attacking Attention of Foundation Models Effectively Disrupts Downstream Tasks`

[CVPR 2025-ADVML] Dépôt officiel pour `Attacking Attention of Foundation Models Effectively Disrupts Downstream Tasks`

Une collection d'exemples concrets de modèles de menaces à travers diverses technologies, offrant des perspectives pratiques pour identifier et…

Flow Integrity Deterministic Enforcement System. Mécanismes de sécurisation des agents d'IA grâce au contrôle de flux d'informations.

AISA-Scanner est un scanner de vulnérabilités autonome propulsé par l'IA qui associe les CVE aux exploits Metasploit, MITRE, CEH et SANS, fournissant…

Outil automatisé de détection de stéganographie qui scanne les sites web, les serveurs web et les répertoires locaux en utilisant la reconnaissance…

Architecture d'apprentissage profond résiliente aux adversaires pour la localisation intérieure 5G sécurisée, combinant CNN et attention multi-têtes…

Ce dépôt fournit l'implémentation officielle de POISONCRAFT : Empoisonnement pratique de la génération augmentée par récupération pour les grands…

Une application CLI interactive pour interagir avec des instances Jupyter authentifiées.

Implémentation d'un tatouage de texte sans distorsion basé sur le couplage optimal afin d'intégrer des signaux détectables dans un texte généré par…

Boîte à outils d'évaluation et d'exploitation des vulnérabilités améliorée par l'IA pour l'analyse modulaire d'applications web, détectant les…

Utilisez les LLM pour le classement des documents

Benchmark standardisé de robustesse adversarial avec un classement public et un zoo de modèles téléchargeable pour évaluer les modèles ML contre les…

Carte basée sur LLM pour la recherche, l'exploration et la découverte.

Découverte de vulnérabilités zero-shot à l'aide de LLMs

Découvrez Eclipse, le seul jailbreak qui fait un moonwalk autour de ChatGPT 4o.

Jeu de données de prompts axé sur la cybersécurité, basé sur l'IA générative, pour l'évaluation comparative des grands modèles de langage.

Un outil d'attaque par gradient de coordonnées glouton (GCG) industrialisé pour les grands modèles de langage (LLMs).

Dépôt de modèles Nuclei générés par IA pour les CVE publiques non encore couvertes par les modèles existants, améliorant la rapidité et la couverture…