
Convierte Claude Code en tu asistente de investigación de seguridad ofensiva. Subagentes de IA especializados para planificar proyectos de pruebas de penetración autorizadas, analizar el reconocimiento, investigar exploits, crear detecciones, auditar STIGs y redactar informes.
50 subagentes de Claude Code para pruebas de penetración.
Inicio rápido | Hoja de referencia | Cobertura | Agentes | Ejemplos
pentest-ai-agents es una colección de 50 subagentes de Claude Code que convierten a Claude en un asistente de investigación ofensiva de seguridad. Cada agente lleva un profundo conocimiento de dominio en un área específica: reconocimiento, web, Active Directory, nube, móvil, inalámbrico, ingeniería social, creación de payloads, ingeniería inversa, encadenamiento de exploits, ingeniería de detección, forense digital y más.
Instala los archivos de agentes. Abre Claude Code. Describe tu tarea. Claude enruta automáticamente al especialista correcto.
Sin servidores, sin dependencias de Python, sin configuración más allá de copiar archivos.
/plugin marketplace add 0xSteph/pentest-ai-agents y luego /plugin install pentest-ai-agents@pentest-ai-agents. La ruta curl de install.sh sigue funcionando sin cambios.ai-recon (mapeo de superficie de ataque de IA), code-auditor, crypto-analyzer, password-auditor, database-attacker, network-attacker, traffic-analyzer, compliance-mapper, risk-scorer, además del conjunto de post-explotación: evasion-specialist, , , , , . Cada agente ofensivo combina sus técnicas con la detección que ejercitan.c2-operator (ajuste de perfiles de Sliver/Mythic/Havoc/Cobalt Strike, higiene de beacons, diseño de redirectores), container-breakout (escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC), opsec-anonymizer (higiene de identidad del operador, diseño de IP de origen, infraestructura desechable, higiene de huellas), llm-redteam (pruebas del Top 10 de OWASP LLM, inyección de prompts, envenenamiento de RAG, abuso de servidores MCP, abuso de herramientas de agentes)._scope-guard.md cubre DoS, escaneo masivo, gusanos no supervisados, operaciones de bandera falsa y sistemas críticos de seguridad de vidas.vulns.tool_used para filtrar hallazgos por la herramienta que los produjo; nuevos índices en cve y tool_used. Las interacciones existentes migran mediante db/migrate.sh.flowchart LR classDef plan fill:#1a2a4a,stroke:#5a7ab8,color:#eaf0ff classDef recon fill:#1a3a2a,stroke:#5ab87a,color:#eaffea classDef exploit fill:#3a1a1a,stroke:#b85a5a,color:#ffeaea classDef post fill:#3a2a1a,stroke:#b8895a,color:#fff0ea classDef defense fill:#1a3a3a,stroke:#5ab8b8,color:#eaffff classDef report fill:#2a1a3a,stroke:#895ab8,color:#f0eaff
EP[engagement-planner]:::plan
OA[opsec-anonymizer]:::plan
TM[threat-modeler]:::plan
OS[osint-collector]:::recon
RA[recon-advisor]:::recon
VS[vuln-scanner]:::recon
WH[web-hunter]:::exploit
AS[api-security]:::exploit
BL[bizlogic-hunter]:::exploit
BB[bug-bounty]:::exploit
AD[ad-attacker]:::exploit
CS[cloud-security]:::exploit
MP[mobile-pentester]:::exploit
WP[wireless-pentester]:::exploit
LR[llm-redteam]:::exploit
SE[social-engineer]:::exploit
PO[phishing-operator]:::exploit
CT[ctf-solver]:::exploit
CR[credential-tester]:::exploit
PV[poc-validator]:::exploit
EG[exploit-guide]:::exploit
EC[exploit-chainer]:::exploit
AP[attack-planner]:::exploit
PC[payload-crafter]:::exploit
RE[reverse-engineer]:::exploit
PE[privesc-advisor]:::post
CB[container-breakout]:::post
C2[c2-operator]:::post
CI[cicd-redteam]:::post
SO[swarm-orchestrator]:::post
DE[detection-engineer]:::defense
FA[forensics-analyst]:::defense
MA[malware-analyst]:::defense
SA[stig-analyst]:::defense
RG[report-generator]:::report
EP --> OA --> OS
EP --> TM
OS --> RA --> VS
VS --> WH & AS & BL & BB & AD & CS & MP & WP & LR
SE --> PO
BB --> WH
PO --> PC --> C2
AD --> CR
AD --> PE
CS --> CB
CB --> PE
WH --> PV
AS --> PV
PV --> EC --> AP
EC --> EG
PC --> RE
RE --> MA
AP --> SO
C2 --> DE
SO --> RG
DE --> FA
MA --> RG
SA --> RG
CT -.solo.-> RG
CI -.pipeline.-> SO
Los agentes de nivel 1 (asesoría) se pueden enrutar desde cualquier tarea. Los agentes de nivel 2 (con capacidad de ejecución) requieren un alcance declarado y residen en el clúster de operaciones ofensivas.
## Novedades en v3.1
- **3 nuevos agentes**: `payload-crafter` (msfvenom, Donut, cargadores personalizados), `reverse-engineer` (Ghidra, JadX, Radare2, Binwalk), `phishing-operator` (Evilginx, GoPhish, dnstwist)
- **Comandos slash**: `/recommend "freeform task"` te enruta al agente correcto + comandos concretos. `/agents-for <tag>` filtra el catálogo por dominio.
- **`db/doctor.sh`**: audita qué herramientas CLI subyacentes están instaladas en tu equipo, agrupadas por agente. Muestra `✔` y `✘` por herramienta con consejos de instalación.
- **`install.sh --tools`**: instalador opcional que incorpora las herramientas subyacentes mediante apt/brew/pacman + pipx/go/cargo.
- **Agentes ampliados**: Commix añadido a web-hunter, RouterSploit añadido a vuln-scanner, generación de wordlists específicas (cupp, CeWL, Mentalist, Crunch, hashid, haiti) añadida a credential-tester, kit de herramientas completo de esteganografía añadido a ctf-solver.
## Inicio rápido
Un solo comando:```bash
curl -fsSL https://raw.githubusercontent.com/0xSteph/pentest-ai-agents/main/install.sh | bash
Eso es todo. El script clona el repositorio en un directorio temporal, copia los agentes a ~/.claude/agents/ y sale. Idempotente: es seguro volver a ejecutarlo para obtener actualizaciones.
O instálalo como un plugin de Claude Code (sin clonar; actualizaciones a través del marketplace):``` /plugin marketplace add 0xSteph/pentest-ai-agents /plugin install pentest-ai-agents@pentest-ai-agents
Esto registra los 52 agentes y los slash commands a través del sistema de plugins de Claude Code. Elige el plugin **o** el instalador — no necesitas ambos.
Luego abre Claude Code:```
"Plan an internal network pentest for a 500-endpoint AD environment with a 2-week window."
Claude se enruta al agente de planificación de compromisos y produce un plan por fases con asignaciones de MITRE ATT&CK.
¿Prefieres clonar primero?```bash git clone https://github.com/0xSteph/pentest-ai-agents.git cd pentest-ai-agents && ./install.sh --global
**Otras opciones de instalación:**```bash
./install.sh --project # Install for current project only
./install.sh --global --lite # Use Haiku for advisory agents (lower cost)
./install.sh --tools # Install underlying CLI tools (nmap, nuclei, ffuf, etc.)
./install.sh --help # All options
See INSTALL.md para obtener instrucciones paso a paso, incluida la configuración inicial de Claude Code.
Interacciones rápidas una vez instalado:
En Claude Code, basta con describir tu tarea y se enruta automáticamente:``` "Plan an internal pentest for a 500-endpoint AD environment, 2-week window." "I have a domain user, where do I look first in BloodHound?" "Convert this SharpHound EXE into shellcode for an EDR test, with detection content." "Reverse this firmware image and tell me what the cryptographic protocol looks like." "Run a phishing simulation against acme-corp.com, set up GoPhish + Evilginx infrastructure."
---
## Coverage
Lo que impulsan los agentes. Las categorías se corresponden con la misma superficie sobre la que operan los adversarios reales:
| Categoría | Agentes | Herramientas subyacentes (instalables mediante `install.sh --tools`) |
|----------|--------|--------------------------------------------------------|
| **Reconocimiento y OSINT** | recon-advisor, osint-collector | nmap, masscan, rustscan, dig, whois, subfinder, amass, httpx, theHarvester, sherlock, holehe, maigret |
| **Escaneo de vulnerabilidades** | vuln-scanner | nuclei, nikto, RouterSploit, nmap NSE, análisis de resultados de OpenVAS/Nessus |
| **Pruebas de aplicaciones web** | web-hunter, api-security, bug-bounty, bizlogic-hunter | ffuf, gobuster, feroxbuster, sqlmap, dalfox, Commix, dirsearch, whatweb |
| **Active Directory** | ad-attacker, credential-tester | BloodHound, Impacket, NetExec/CrackMapExec, Certipy, kerbrute, Responder, ldapsearch |
| **Credenciales y cracking** | credential-tester, password-auditor | Hydra, Hashcat, John, Medusa, cupp, CeWL, auditoría de políticas NIST 800-63B, anonimato k de HIBP |
| **Nube** | cloud-security, cicd-redteam | aws/az/gcloud CLIs, Trivy, Prowler, ScoutSuite, Pacu |
| **Contenedores y breakout en K8s** | container-breakout | kubectl, kube-hunter, peirates, CDK, emparejamiento con reglas de Falco |
| **Operaciones C2** | c2-operator | Sliver, Mythic, Havoc, Cobalt Strike, perfiles malleable, diseño de redirectores |
| **Red teaming de IA / LLM** | ai-recon, llm-redteam | descubrimiento de superficie A2A/MCP/RAG, huella de modelo, Garak, PyRIT, Promptfoo, OWASP LLM Top 10, MITRE ATLAS |
| **Opsec del operador** | opsec-anonymizer | diseño de IP de origen, identidad desechable, higiene de JA3/huellas, listas de verificación de quema |
| **Móvil** | mobile-pentester, reverse-engineer | Frida, Objection, jadx, apktool, MobSF, adb |
| **Inalámbrico** | wireless-pentester | aircrack-ng, hcxdumptool, hcxtools, bettercap, wifite |
| **Ingeniería social** | social-engineer, phishing-operator | GoPhish, Evilginx, dnstwist, Modlishka |
| **Creación de payloads** | payload-crafter | msfvenom, Donut, MSFvenom Payload Creator, patrones de loaders personalizados |
| **Ingeniería inversa** | reverse-engineer, malware-analyst | Ghidra, Radare2, JadX, Binwalk, Apktool, IDA, dnSpy, Volatility 3 |
| **Forense y respuesta a incidentes (IR)** | forensics-analyst, malware-analyst | Volatility 3, exiftool, foremost, YARA, Wireshark/tshark, Autopsy |
| **Encadenamiento de exploits** | exploit-chainer, attack-planner, poc-validator | composición de ataques multi-paso, puntuación de cadenas mapeadas a ATT&CK |
| **Ataques a bases de datos** | database-attacker | sqlmap, NoSQLMap, clientes nativos (MySQL/PostgreSQL/MSSQL/Oracle/MongoDB/Redis) |
| **Red L2/L3 y tráfico** | network-attacker, traffic-analyzer | Responder, ntlmrelayx, mitm6, bettercap, Wireshark/tshark, Zeek |
| **Post-explotación** | lateral-movement, persistence-planner, evasion-specialist, data-exfiltrator | PtH/PtT, WMI/WinRM/DCOM, evasión de AMSI/ETW, exfiltración por DNS/HTTPS, golden ticket |
| **ICS / OT** | scada-attacker | Modbus, DNP3, S7comm, EtherNet/IP, OPC-UA, emparejamiento con IDS consciente de OT |
| **IoT / embebido** | iot-pentester | binwalk, UART/JTAG/SPI, BLE/Zigbee/sub-GHz, análisis de firmware |
| **Código seguro y criptografía** | code-auditor, crypto-analyzer | Semgrep, CodeQL, gitleaks, testssl.sh, jwt_tool |
| **Detección y defensa** | detection-engineer, threat-modeler, stig-analyst | Sigma, Splunk SPL, Elastic KQL, Sentinel KQL, STRIDE/DREAD, DISA STIG |
| **CTF** | ctf-solver | zsteg, steghide, stegseek, pngcheck, más cadena de herramientas genérica |
| **Reportes, riesgo y cumplimiento** | engagement-planner, report-generator, risk-scorer, compliance-mapper | mapeo MITRE ATT&CK, CVSS 3.1/4.0, EPSS, CISA KEV, mapeo PCI/NIST/ISO/CIS |
Ejecuta `bash db/doctor.sh` para ver cuáles de estas herramientas están presentes en tu equipo ahora mismo y cuáles faltan.
---
## Agentes
### Operaciones Ofensivas
| Agente | Qué hace |
|-------|-------------|
| **Engagement Planner** | Planes de pentest por fases con mapeos MITRE ATT&CK, estimaciones de tiempo y plantillas de ROE |
| **Recon Advisor** | Analiza la salida de Nmap/Nessus/BloodHound, prioriza objetivos, recomienda próximos comandos. *Nivel 2: ejecuta herramientas de reconocimiento directamente.* |
| **OSINT Collector** | Reconocimiento de dominios, recolección de correos electrónicos, perfilado en redes sociales, análisis de datos de filtraciones |
| **Exploit Guide** | Metodología de ataque para AD, web, nube y post-explotación con perspectiva defensiva |
| **Privilege Escalation** | Escalada de privilegios en Linux y Windows: SUID, tokens, servicios, exploits de kernel, escape de contenedores |
| **Cloud Security** | Pentesting en AWS/Azure/GCP: escalada de IAM, escape de contenedores, explotación serverless |
| **API Security** | Pruebas de REST, GraphQL, WebSocket. OWASP API Top 10, ataques JWT, explotación de OAuth |
| **Mobile Pentester** | Análisis de Android/iOS con Frida, Objection, jadx. Mapeo OWASP MASTG/MASVS |
| **Wireless Pentester** | WPA/WPA2/WPA3, evil twin, AP rogue, 802.1X empresarial, seguridad Bluetooth |
| **Social Engineer** | Campañas de phishing, pretexting, vishing para compromisos de red team autorizados |
| **Vuln Scanner** | Escaneos con Nuclei, Nikto, Nmap NSE. Analiza resultados de Nessus/OpenVAS. *Nivel 2: ejecuta escaneos.* |
| **Web Hunter** | ffuf, gobuster, sqlmap, dalfox. Descubrimiento de contenido, fuzzing, detección de WAF. *Nivel 2: ejecuta herramientas web.* |
| **Credential Tester** | Hydra, Hashcat, John, CrackMapExec. Identificación de hashes, generación de wordlists |
| **Attack Planner** | Correlaciona hallazgos en cadenas de ataque multi-paso. Puntúa por probabilidad, sigilo e impacto |
| **Supply Chain Auditor** | Inventario SBOM, exposición a dependency confusion y typosquatting, revisión de install-hooks, integridad de lockfiles y procedencia |
| **Bug Bounty Hunter** | Metodología HackerOne/Bugcrowd, evasión de duplicados, redacción de reportes para maximizar recompensas |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy. Kerberos, delegación, ACL y abuso de certificados. *Nivel 2: ejecuta herramientas de AD.* |
| **Exploit Chainer** | Encadena hallazgos de baja severidad en rutas de compromiso completas. Paso a paso con puntos de aprobación. *Nivel 2.* |
| **PoC Validator** | Genera y ejecuta de forma segura scripts de prueba de concepto. Elimina falsos positivos. *Nivel 2.* |
| **Payload Crafter** | msfvenom, Donut, loaders personalizados. Empareja cada payload con contenido de detección YARA/Sigma. |
| **Reverse Engineer** | Ghidra, JadX, Radare2, Binwalk. Análisis estático de firmware, aplicaciones móviles y binarios. |
| **Phishing Operator** | Infraestructura con Evilginx, GoPhish, dnstwist. Herramientas de campañas en vivo para red team autorizado. |
| **Swarm Orchestrator** | Coordina a todos los agentes como un enjambre de red team. Flujos de trabajo paralelos, seguimiento del progreso. |
| **Business Logic Hunter** | Manipulación de precios, bypass de flujos de trabajo, condiciones de carrera, fallos de autorización. *Nivel 2.* |
| **CI/CD Red Team** | GitHub Actions, GitLab CI, configuraciones de pipeline en Jenkins con puertas de seguridad |
| **C2 Operator** | Sliver, Mythic, Havoc, Cobalt Strike. Ajuste de listeners, higiene de beacons, diseño de redirectores, quema de compromiso |
| **Container Breakout** | Escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC, bypass del admission controller |
| **OpSec Anonymizer** | Higiene de identidad del operador, estrategia de IP de origen, infraestructura desechable, higiene de huellas de navegador/JA3 |
| **LLM Red Team** | Pruebas OWASP LLM Top 10, inyección de prompts, envenenamiento de RAG, abuso de herramientas de agentes, explotación de servidores MCP |
| **AI Recon** | Mapea la superficie de ataque de IA: endpoints de IA/LLM, tarjetas de agente A2A, exposición de MCP, superficie de RAG/herramientas, huella del modelo. *Nivel 2: ejecuta reconocimiento de solo lectura.* |
| **Password Auditor** | Auditoría de políticas NIST 800-63B + almacenamiento de hashes, exposición en filtraciones (anonimato k de HIBP), planificación de spray seguro contra bloqueos |
| **Database Attacker** | Profundidad de inyección SQL/NoSQL, escalada de privilegios en BD, extracción acotada a prueba en los principales motores. *Nivel 2.* |
| **Network Attacker** | Envenenamiento LLMNR/NBT-NS, relay NTLM, mitm6, MITM ARP, pivoting. *Nivel 2: ejecuta ataques L2/L3.* |
| **Evasion Specialist** | Evasión de AV/EDR, bypass de AMSI/ETW, ejecución en memoria: cada técnica emparejada con su detección |
| **Persistence Planner** | Persistencia en host/AD/nube (golden ticket, WMI, servicios) con seguimiento obligatorio de limpieza + detección |
| **Data Exfiltrator** | Exfiltración por DNS/HTTPS/ICMP y pruebas de DLP/egress con datos sintéticos/canarios, emparejadas con detección |
| **SCADA Attacker** | Análisis de protocolos ICS/OT (Modbus/DNP3/S7comm/OPC-UA), con compuertas de seguridad, pasivo primero |
| **IoT Pentester** | Firmware, interfaces de hardware (UART/JTAG), radio (BLE/sub-GHz) y pruebas dispositivo-nube |
| **Lateral Movement** | PtH/PtT, WMI/WinRM/DCOM/SSH, robo de tokens, planificación de pivoting, emparejado con detección |
### Defensa y Análisis
| Agente | Qué hace |
|-------|-------------|
| **Fix Verifier** | Vuelve a probar un hallazgo después de un parche. Reproduce la prueba original, prueba la clase, no la cadena, y marca correcciones parciales y regresiones |
| **Detection Engineer** | Reglas Sigma, Splunk SPL, Elastic KQL, Sentinel KQL con ajuste de falsos positivos |
| **Threat Modeler** | Análisis STRIDE/DREAD, árboles de ataque, diagramas de flujo de datos |
| **Forensics Analyst** | Adquisición de evidencia, forense de memoria, análisis de disco, construcción de líneas de tiempo |
| **Malware Analyst** | Análisis estático/dinámico, ingeniería inversa, reglas YARA, extracción de IOC |
| **STIG Analyst** | Cumplimiento DISA STIG, rutas de remediación de GPO, plantillas de justificación de excepciones |
| **Code Auditor** | Revisión de código seguro: inyección, autorización, secretos, deserialización (Semgrep, CodeQL, gitleaks) |
| **Crypto Analyzer** | Algoritmos/modos débiles, manejo de claves y IV/nonce, configuración TLS/certificados, problemas de tokens JWT/JWE |
| **Traffic Analyzer** | Análisis de pcap offline: disección de protocolos, extracción de credenciales, búsqueda de beacons/anomalías |
### Reportes y Aprendizaje
| Agente | Qué hace |
|-------|-------------|
| **Report Generator** | Reportes profesionales de pentest con resúmenes ejecutivos, puntuación CVSS, hojas de ruta de remediación |
| **CTF Solver** | HackTheBox, TryHackMe, PicoCTF. Web, pwn, rev, crypto, forense, OSINT |
| **Compliance Mapper** | Mapea hallazgos a PCI DSS, NIST 800-53/CSF, ISO 27001, CIS, HIPAA, SOC 2 con análisis de brechas de controles |
| **Risk Scorer** | Vectores CVSS 3.1/4.0, enriquecimiento con EPSS + CISA KEV, priorización de remediación según contexto de negocio |
---
## Nivel 1 vs Nivel 2
**Nivel 1 (todos los agentes):** Modo asesor. Pegas la salida de las herramientas, haces preguntas de metodología, recibes análisis y recomendaciones. Las herramientas las ejecutas tú mismo.
**Nivel 2 (agentes seleccionados):** También pueden componer y ejecutar comandos directamente. Declaras tu alcance autorizado, el agente valida cada objetivo contra ese alcance, y Claude Code te muestra cada comando para que lo apruebes antes de ejecutarlo.
| Agente de Nivel 2 | Qué ejecuta |
|-------|-----------------|
| **Recon Advisor** | nmap, dig, whois, curl, netcat, traceroute, whatweb, nikto |
| **Vuln Scanner** | nuclei, nikto, scripts NSE de nmap |
| **Web Hunter** | ffuf, gobuster, feroxbuster, sqlmap, dalfox, whatweb |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy, ldapsearch, enum4linux |
| **Exploit Chainer** | Ejecución de cadenas multi-paso con aprobación en cada compuerta |
| **PoC Validator** | Scripts de prueba de concepto seguros y no destructivos |
| **Business Logic Hunter** | Pruebas de fallos lógicos (manipulación de precios, condiciones de carrera) |
| **AI Recon** | Descubrimiento de endpoints de IA, sondeos de /v1/models, enumeración A2A/MCP (solo lectura) |
| **Database Attacker** | sqlmap, NoSQLMap, clientes nativos de BD (acotados a prueba, no destructivos) |
| **Network Attacker** | Responder, ntlmrelayx, mitm6, bettercap (posicionamiento L2/L3 acotado) |
| **CI/CD Red Team** | Escaneos SAST/DAST/secretos impulsados por pipelines contra objetivos dentro del alcance |
Consulta [docs/TIER2-EXECUTION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md) para conocer el modelo de seguridad completo.
---
## Ejemplos```
$ claude
You: Analyze this Nmap scan and prioritize targets for our internal pentest
> Routing to recon-advisor agent...
## Prioritized Target Summary
### Critical Priority
| Host | Port | Service | Finding |
|------------|------|---------|--------------------------|
| 10.10.1.5 | 445 | SMB | SMBv1 enabled, MS17-010 |
| 10.10.1.20 | 3389 | RDP | BlueKeep (CVE-2019-0708) |
### Recommended Next Steps
1. nmap -sV --script smb-vuln* 10.10.1.5
2. crackmapexec smb 10.10.1.0/24
3. bloodhound-python -d corp.local
Más ejemplos en el directorio examples/:
Ejecute sus herramientas de seguridad dentro de un contenedor Docker para mantener su estación de trabajo limpia y evitar las alertas de protección de endpoints.```bash docker pull kalilinux/kali-rolling docker run -it --name pentest-lab kalilinux/kali-rolling /bin/bash apt update && apt install -y nmap nikto sqlmap metasploit-framework bloodhound
Usa agentes pentest-ai en tu host para metodología y análisis. Ejecuta las herramientas reales dentro del contenedor.
---
## Base de datos de hallazgos
Almacenamiento SQLite persistente que conserva los datos del engagement a lo largo de las sesiones de Claude Code.```bash
findings.sh init acme-2024 --client "ACME Corp" --type internal --scope "10.0.0.0/24"
export PENTEST_AI_ENGAGEMENT="acme-2024"
findings.sh stats # Check progress
findings.sh list vulns # See all findings
findings.sh export # Full JSON export
bash handoff.sh # Markdown handoff report for next session
Los agentes de nivel 2 escriben en la base de datos automáticamente cuando findings.sh está en PATH. Consulta docs/FINDINGS-DB.md para la documentación completa.
Instala con el modo lite para ejecutar agentes de asesoramiento en Haiku (menor costo, misma metodología):```bash ./install.sh --global --lite
Consulta [docs/TOKEN-OPTIMIZATION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) para la guía completa.
---
## Modelos Locales
Los agentes son prompts de sistema en markdown simple — la única parte específica de Claude es el encabezado frontmatter YAML. Se ejecutan en cualquier modelo: apunta Claude Code a cualquier endpoint compatible con Anthropic configurando `ANTHROPIC_BASE_URL`, o copia el prompt de sistema (todo lo que está debajo del frontmatter) en cualquier ejecutor local como Ollama o LM Studio.
Consulta [docs/LOCAL-SETUP.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) para notas sobre modelos locales.
---
## Documentación
| Documento | Descripción |
|----------|-------------|
| [INSTALL.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/INSTALL.md) | Guía de instalación con solución de problemas |
| [Agent Guide](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/AGENT-GUIDE.md) | Cómo funciona cada agente y cuándo usarlo |
| [Tier 2 Execution](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md) | Modelo de seguridad del modo de ejecución y guía de conversión |
| [Local Setup](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) | Ejecuta sin conexión con Ollama y GPU local |
| [Customization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/CUSTOMIZATION.md) | Modifica agentes, cambia modelos, crea nuevos agentes |
| [Token Optimization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) | Reduce el consumo de tokens |
| [Findings Database](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/FINDINGS-DB.md) | Almacenamiento persistente SQLite para datos de engagement |
| [Data Privacy](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/DATA-PRIVACY.md) | Manejo de datos de LLM y opciones de modelos locales |
| [Changelog](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/CHANGELOG.md) | Historial de versiones |
---
## Servidor MCP
¿Buscas el pipeline automatizado? **[pentest-ai](https://github.com/0xSteph/pentest-ai)** es el servidor MCP complementario con más de 150 wrappers de herramientas, encadenamiento autónomo de exploits e integración CI/CD. Funciona con Claude Desktop, Cursor, VS Code Copilot y cualquier cliente MCP.
---
## Requisitos previos
- [Claude Code](https://docs.anthropic.com/en/docs/claude-code) instalado y configurado
- Suscripción a Claude Pro o Max
- Para pruebas de seguridad: reglas de compromiso firmadas y alcance definido
---
## Aviso legal
Este kit de herramientas es solo para **pruebas de seguridad autorizadas**. Los usuarios deben contar con la autorización escrita correspondiente antes de usar estos agentes en cualquier engagement. Consulta [DISCLAIMER.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/DISCLAIMER.md) para conocer los términos completos.
---
## Licencia
[Licencia MIT](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/LICENSE)
---
<div align="center">
Creado por [0xSteph](https://github.com/0xSteph) · [pentestai.xyz](https://pentestai.xyz)
</div>
persistence-plannerdata-exfiltratorscada-attackeriot-pentesterlateral-movementcicd-redteam tenía capacidad Bash pero le faltaba el bloque obligatorio de aplicación de alcance; ahora está corregido (la nueva comprobación CI lo habría detectado).curl | bash ya no falla con set -u, la URL de clonado de una línea está corregida, los comandos slash ahora se instalan junto con los agentes, y --uninstall elimina todo limpiamente.| Comando | Qué hace |
|---|
/recommend "phish a small SaaS team's IT department" | Selecciona el agente adecuado y da los siguientes comandos concretos |
/agents-for web | Lista todos los agentes relevantes para pruebas web (web-hunter, api-security, bug-bounty, bizlogic-hunter) |
/agents-for cloud | Agentes específicos de la nube (cloud-security, cicd-redteam) |
db/doctor.sh | Audita qué herramientas CLI subyacentes tienes, agrupadas por agente. Muestra ✔/✘ y sugerencias de instalación. |
db/doctor.sh --agent ad-attacker | Audita solo la pila de herramientas de AD |
db/doctor.sh --json | Salida legible por máquina para canalizar a un script |
install.sh --tools | Instala las herramientas subyacentes mediante tu gestor de paquetes + pipx/go/cargo |
findings.sh init <id> | Inicia un nuevo encargo (base de datos de hallazgos SQLite persistente) |
findings.sh stats | Progreso del encargo |
findings.sh export | Exportación JSON completa |
bash handoff.sh | Informe de traspaso Markdown entre sesiones |
| Ejemplo | Agente | Lo que muestra |
|---|
| Engagement Plan | engagement-planner | Plan por fases completo con mapeos MITRE ATT&CK |
| Nmap Analysis | recon-advisor | Vectores de ataque priorizados con comandos de seguimiento |
| Detection Rule | detection-engineer | Detección de Kerberoasting en Sigma, SPL y KQL |
| STIG Finding | stig-analyst | Análisis STIG con ruta de GPO y plantilla keep-open |
| Report Excerpt | report-generator | Hallazgo de inyección SQL formateado para un informe de pentest |