Skip to content
KitploitKITPLOIT
HerramientasBlog
Enviar
HerramientasBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

··Feeds·Contacto·Privacidad·© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
Defenses-for-Tool-Integrated-LLM — Investigación de código y experimentos para defender agentes LLM integrados con herramientas contra ataques adversarios, ampliando Agent Security Bench con nuevas estrategias de defensa y escenarios de ataque. | Kitploit
Herramientas/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
Herramientas DefensivasAprendizaje AutomáticoPapers e InvestigaciónAprendizaje y EducaciónSeguridad de IAAtaque Adversario
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

Investigación de código y experimentos para defender agentes LLM integrados con herramientas contra ataques adversarios, ampliando Agent Security Bench con nuevas estrategias de defensa y escenarios de ataque.

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Ver Repositorio
hace 11 mesesAún no revisado
Compartir

Defensas universales para agentes LLM integrados con herramientas contra ataques adversarios

Este repositorio contiene el código y los experimentos de nuestro proyecto sobre la defensa de agentes de modelos de lenguaje de gran tamaño (LLM) integrados con herramientas contra ataques adversarios.

Framework overview

Descripción general

Nos basamos en Agent Security Bench (ASB) para evaluar cómo la integración de herramientas y el razonamiento estructurado (por ejemplo, cadena de pensamiento, reflexión) afecta la vulnerabilidad de los agentes LLM a los prompts adversarios en múltiples escenarios de tareas.

Este repositorio incluye:

  • Nuevas estrategias de defensa (por ejemplo, filtrado basado en herramientas, CoT+Reflection)
  • Escenarios de ataque adaptados de ASB
  • Scripts experimentales

Basado en Agent Security Bench (ASB)

Este proyecto adapta y extiende el código del repositorio oficial de ASB:

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

Agradecemos a los autores de ASB por hacer su framework disponible públicamente.

Instalar dependencias

root@kitploit:~
pip install -r requirements.txt

Uso

Para evaluar el DPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

Para evaluar el IPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

Para evaluar el MP:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

Para evaluar el ataque de puerta trasera:

root@kitploit:~
python agent_attack_pot.py
Descargar herramienta