Skip to content
KitploitKITPLOIT
OutilsBlog
Soumettre
OutilsBlog
Soumettre

Outils de Hacking, PenTest et Cybersécurité pour votre Arsenal de Sécurité !

Kitploit est un répertoire d'outils de hacking, de cybersécurité et de pentesting. Découvrez les dernières mises à jour des projets pour trouver des vulnérabilités, analyser des systèmes, automatiser les tests et renforcer votre sécurité.

··Flux·Contact·Confidentialité·© 2026 Kitploit

Répertoire d'outils

Catégories

Voir toutes les catégories
Loading categories
Defenses-for-Tool-Integrated-LLM — Recherche de code et expériences pour défendre les agents LLM intégrés à des outils contre les attaques adversariales, en étendant Agent Security Bench avec de nouvelles stratégies de défense et scénarios d'attaque. | Kitploit
Outils/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
Outils DéfensifsApprentissage AutomatiqueArticles et RechercheApprentissage et ÉducationSécurité de l'IAAttaque Adversariale
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

Recherche de code et expériences pour défendre les agents LLM intégrés à des outils contre les attaques adversariales, en étendant Agent Security Bench avec de nouvelles stratégies de défense et scénarios d'attaque.

Populaires

Voir tout →

Découvrez les outils les plus utilisés par notre communauté.

Explorer tous les outils

Parcourez notre collection d'outils

Voir tous les outils →
Voir le dépôt
il y a 11 moisPas encore vérifié
Partager

Défenses universelles pour les agents LLM intégrés à des outils contre les attaques adversariales

Ce dépôt contient le code et les expériences de notre projet sur la défense des agents de grands modèles de langage (LLM) intégrés à des outils contre les attaques adversariales.

Framework overview

Aperçu

Nous nous appuyons sur Agent Security Bench (ASB) pour évaluer comment l'intégration d'outils et le raisonnement structuré (par exemple, la chaîne de pensée, la réflexion) affectent la vulnérabilité des agents LLM aux invites adversariales dans plusieurs scénarios de tâches.

Ce dépôt comprend :

  • De nouvelles stratégies de défense (par exemple, filtrage basé sur les outils, CoT+Reflection)
  • Des scénarios d'attaque adaptés d'ASB
  • Des scripts expérimentaux

Basé sur Agent Security Bench (ASB)

Ce projet adapte et étend le code du dépôt officiel ASB :

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

Nous remercions les auteurs d'ASB d'avoir rendu leur framework publiquement disponible.

Installer les dépendances

root@kitploit:~
pip install -r requirements.txt

Utilisation

Pour évaluer le DPI :

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

Pour évaluer l'IPI :

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

Pour évaluer le MP :

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

Pour évaluer l'attaque par porte dérobée :

root@kitploit:~
python agent_attack_pot.py
Télécharger l’outil