
pentest-ai-agents v3.4.0
Convierte Claude Code en tu asistente de investigación de seguridad ofensiva. Subagentes de IA especializados para planificar proyectos de pruebas de penetración autorizadas, analizar el reconocimiento, investigar exploits, crear detecciones, auditar STIGs y redactar informes.
pentest-ai-agents
50 subagentes de Claude Code para pruebas de penetración.
Inicio rápido | Hoja de referencia | Cobertura | Agentes | Ejemplos
Tabla de contenidos
- Novedades en v3.3
- Novedades en v3.2
- Mapa de agentes
- Novedades en v3.1
- Inicio rápido
- Hoja de referencia
- Cobertura
- Agentes
- Nivel 1 vs Nivel 2
- Ejemplos
- Ejecutar herramientas en un contenedor
- Base de datos de hallazgos
- Optimización de tokens
- Modelos locales
- Documentación
- Servidor MCP
- Requisitos previos
- Aviso legal
- Licencia
pentest-ai-agents es una colección de 50 subagentes de Claude Code que convierten a Claude en un asistente de investigación ofensiva de seguridad. Cada agente lleva un profundo conocimiento de dominio en un área específica: reconocimiento, web, Active Directory, nube, móvil, inalámbrico, ingeniería social, creación de payloads, ingeniería inversa, encadenamiento de exploits, ingeniería de detección, forense digital y más.
Instala los archivos de agentes. Abre Claude Code. Describe tu tarea. Claude enruta automáticamente al especialista correcto.
Sin servidores, sin dependencias de Python, sin configuración más allá de copiar archivos.
Novedades en v3.3
- Instalable como plugin de Claude Code. Dos líneas:
/plugin marketplace add 0xSteph/pentest-ai-agentsy luego/plugin install pentest-ai-agents@pentest-ai-agents. La ruta curl deinstall.shsigue funcionando sin cambios. - 15 agentes nuevos (35 → 50):
ai-recon(mapeo de superficie de ataque de IA),code-auditor,crypto-analyzer,password-auditor,database-attacker,network-attacker,traffic-analyzer,compliance-mapper,risk-scorer, además del conjunto de post-explotación:evasion-specialist,persistence-planner,data-exfiltrator,scada-attacker,iot-pentester,lateral-movement. Cada agente ofensivo combina sus técnicas con la detección que ejercitan. - Validador CI reforzado. Un flujo de trabajo de mínimos privilegios y con hash SHA fijado valida el frontmatter de cada agente, exige el bloque de protección de alcance en todo agente con capacidad Bash (Nivel 2), comprueba los manifiestos del plugin y realiza pruebas de humo al instalador.
- Brecha del protector de alcance cerrada.
cicd-redteamtenía capacidad Bash pero le faltaba el bloque obligatorio de aplicación de alcance; ahora está corregido (la nueva comprobación CI lo habría detectado). - Correcciones del instalador.
curl | bashya no falla conset -u, la URL de clonado de una línea está corregida, los comandos slash ahora se instalan junto con los agentes, y--uninstallelimina todo limpiamente. - Paquete Docker offline mínimo con imagen base de digest fijado y usuario no root — solo empaquetado, sin herramientas incluidas.
Novedades en v3.2
- 4 agentes nuevos:
c2-operator(ajuste de perfiles de Sliver/Mythic/Havoc/Cobalt Strike, higiene de beacons, diseño de redirectores),container-breakout(escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC),opsec-anonymizer(higiene de identidad del operador, diseño de IP de origen, infraestructura desechable, higiene de huellas),llm-redteam(pruebas del Top 10 de OWASP LLM, inyección de prompts, envenenamiento de RAG, abuso de servidores MCP, abuso de herramientas de agentes). - Protector de alcance reforzado: lista explícita de rechazo en
_scope-guard.mdcubre DoS, escaneo masivo, gusanos no supervisados, operaciones de bandera falsa y sistemas críticos de seguridad de vidas. - Base de datos de hallazgos v2: columna
vulns.tool_usedpara filtrar hallazgos por la herramienta que los produjo; nuevos índices encveytool_used. Las interacciones existentes migran mediantedb/migrate.sh. - Diagrama de mapa de agentes: flujo visual desde reconocimiento hasta cierre mapeado a nombres de agentes (ver más abajo).
Mapa de agentes```mermaid
flowchart LR classDef plan fill:#1a2a4a,stroke:#5a7ab8,color:#eaf0ff classDef recon fill:#1a3a2a,stroke:#5ab87a,color:#eaffea classDef exploit fill:#3a1a1a,stroke:#b85a5a,color:#ffeaea classDef post fill:#3a2a1a,stroke:#b8895a,color:#fff0ea classDef defense fill:#1a3a3a,stroke:#5ab8b8,color:#eaffff classDef report fill:#2a1a3a,stroke:#895ab8,color:#f0eaff
EP[engagement-planner]:::plan
OA[opsec-anonymizer]:::plan
TM[threat-modeler]:::plan
OS[osint-collector]:::recon
RA[recon-advisor]:::recon
VS[vuln-scanner]:::recon
WH[web-hunter]:::exploit
AS[api-security]:::exploit
BL[bizlogic-hunter]:::exploit
BB[bug-bounty]:::exploit
AD[ad-attacker]:::exploit
CS[cloud-security]:::exploit
MP[mobile-pentester]:::exploit
WP[wireless-pentester]:::exploit
LR[llm-redteam]:::exploit
SE[social-engineer]:::exploit
PO[phishing-operator]:::exploit
CT[ctf-solver]:::exploit
CR[credential-tester]:::exploit
PV[poc-validator]:::exploit
EG[exploit-guide]:::exploit
EC[exploit-chainer]:::exploit
AP[attack-planner]:::exploit
PC[payload-crafter]:::exploit
RE[reverse-engineer]:::exploit
PE[privesc-advisor]:::post
CB[container-breakout]:::post
C2[c2-operator]:::post
CI[cicd-redteam]:::post
SO[swarm-orchestrator]:::post
DE[detection-engineer]:::defense
FA[forensics-analyst]:::defense
MA[malware-analyst]:::defense
SA[stig-analyst]:::defense
RG[report-generator]:::report
EP --> OA --> OS
EP --> TM
OS --> RA --> VS
VS --> WH & AS & BL & BB & AD & CS & MP & WP & LR
SE --> PO
BB --> WH
PO --> PC --> C2
AD --> CR
AD --> PE
CS --> CB
CB --> PE
WH --> PV
AS --> PV
PV --> EC --> AP
EC --> EG
PC --> RE
RE --> MA
AP --> SO
C2 --> DE
SO --> RG
DE --> FA
MA --> RG
SA --> RG
CT -.solo.-> RG
CI -.pipeline.-> SO
Los agentes de nivel 1 (asesoría) se pueden enrutar desde cualquier tarea. Los agentes de nivel 2 (con capacidad de ejecución) requieren un alcance declarado y residen en el clúster de operaciones ofensivas.
## Novedades en v3.1