Skip to content
KitploitKITPLOIT
HerramientasBlog
Enviar
HerramientasBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

··Feeds·Contacto·Privacidad·© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
pentest-ai-agents — Convierte Claude Code en tu asistente de investigación de seguridad ofensiva. Subagentes de IA especializados para planificar proyectos de pruebas de penetración autorizadas, analizar el reconocimiento, investigar exploits, crear detecciones, auditar STIGs y redactar informes. | Kitploit
Herramientas/GitHubGitHub/0xsteph/pentest-ai-agents
Frameworks de Pruebas de PenetraciónReconocimientoEscáneres de VulnerabilidadesFrameworks de ExploitsSeguridad WebPruebas de PenetraciónSeguridad en la NubeSeguridad MóvilAprendizaje y Educación

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Compartir
Red Teaming
Seguridad de IA
GitHub0xsteph/pentest-ai-agents

pentest-ai-agents

Convierte Claude Code en tu asistente de investigación de seguridad ofensiva. Subagentes de IA especializados para planificar proyectos de pruebas de penetración autorizadas, analizar el reconocimiento, investigar exploits, crear detecciones, auditar STIGs y redactar informes.

Ver RepositorioSitio web
2.1k403hace 5 díasRevisado por Kitploit

pentest-ai-agents

50 subagentes de Claude Code para pruebas de penetración.

License: MIT Claude Code Agents Tools Tracked GitHub stars

Inicio rápido | Hoja de referencia | Cobertura | Agentes | Ejemplos


Tabla de contenidos

  • Novedades en v3.3
  • Novedades en v3.2
  • Mapa de agentes
  • Novedades en v3.1
  • Inicio rápido
  • Hoja de referencia
  • Cobertura
  • Agentes
  • Nivel 1 vs Nivel 2
  • Ejemplos
  • Ejecutar herramientas en un contenedor
  • Base de datos de hallazgos
  • Optimización de tokens
  • Modelos locales
  • Documentación
  • Servidor MCP
  • Requisitos previos
  • Aviso legal
  • Licencia

pentest-ai-agents es una colección de 50 subagentes de Claude Code que convierten a Claude en un asistente de investigación ofensiva de seguridad. Cada agente lleva un profundo conocimiento de dominio en un área específica: reconocimiento, web, Active Directory, nube, móvil, inalámbrico, ingeniería social, creación de payloads, ingeniería inversa, encadenamiento de exploits, ingeniería de detección, forense digital y más.

Instala los archivos de agentes. Abre Claude Code. Describe tu tarea. Claude enruta automáticamente al especialista correcto.

Sin servidores, sin dependencias de Python, sin configuración más allá de copiar archivos.

Novedades en v3.3

  • Instalable como plugin de Claude Code. Dos líneas: /plugin marketplace add 0xSteph/pentest-ai-agents y luego /plugin install pentest-ai-agents@pentest-ai-agents. La ruta curl de install.sh sigue funcionando sin cambios.
  • 15 agentes nuevos (35 → 50): ai-recon (mapeo de superficie de ataque de IA), code-auditor, crypto-analyzer, password-auditor, database-attacker, network-attacker, traffic-analyzer, compliance-mapper, risk-scorer, además del conjunto de post-explotación: evasion-specialist, , , , , . Cada agente ofensivo combina sus técnicas con la detección que ejercitan.

Novedades en v3.2

  • 4 agentes nuevos: c2-operator (ajuste de perfiles de Sliver/Mythic/Havoc/Cobalt Strike, higiene de beacons, diseño de redirectores), container-breakout (escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC), opsec-anonymizer (higiene de identidad del operador, diseño de IP de origen, infraestructura desechable, higiene de huellas), llm-redteam (pruebas del Top 10 de OWASP LLM, inyección de prompts, envenenamiento de RAG, abuso de servidores MCP, abuso de herramientas de agentes).
  • Protector de alcance reforzado: lista explícita de rechazo en _scope-guard.md cubre DoS, escaneo masivo, gusanos no supervisados, operaciones de bandera falsa y sistemas críticos de seguridad de vidas.
  • Base de datos de hallazgos v2: columna vulns.tool_used para filtrar hallazgos por la herramienta que los produjo; nuevos índices en cve y tool_used. Las interacciones existentes migran mediante db/migrate.sh.
  • Diagrama de mapa de agentes: flujo visual desde reconocimiento hasta cierre mapeado a nombres de agentes (ver más abajo).

Mapa de agentes```mermaid

flowchart LR classDef plan fill:#1a2a4a,stroke:#5a7ab8,color:#eaf0ff classDef recon fill:#1a3a2a,stroke:#5ab87a,color:#eaffea classDef exploit fill:#3a1a1a,stroke:#b85a5a,color:#ffeaea classDef post fill:#3a2a1a,stroke:#b8895a,color:#fff0ea classDef defense fill:#1a3a3a,stroke:#5ab8b8,color:#eaffff classDef report fill:#2a1a3a,stroke:#895ab8,color:#f0eaff

root@kitploit:~
EP[engagement-planner]:::plan
OA[opsec-anonymizer]:::plan
TM[threat-modeler]:::plan

OS[osint-collector]:::recon
RA[recon-advisor]:::recon
VS[vuln-scanner]:::recon

WH[web-hunter]:::exploit
AS[api-security]:::exploit
BL[bizlogic-hunter]:::exploit
BB[bug-bounty]:::exploit
AD[ad-attacker]:::exploit
CS[cloud-security]:::exploit
MP[mobile-pentester]:::exploit
WP[wireless-pentester]:::exploit
LR[llm-redteam]:::exploit
SE[social-engineer]:::exploit
PO[phishing-operator]:::exploit
CT[ctf-solver]:::exploit
CR[credential-tester]:::exploit
PV[poc-validator]:::exploit
EG[exploit-guide]:::exploit
EC[exploit-chainer]:::exploit
AP[attack-planner]:::exploit
PC[payload-crafter]:::exploit
RE[reverse-engineer]:::exploit

PE[privesc-advisor]:::post
CB[container-breakout]:::post
C2[c2-operator]:::post
CI[cicd-redteam]:::post
SO[swarm-orchestrator]:::post

DE[detection-engineer]:::defense
FA[forensics-analyst]:::defense
MA[malware-analyst]:::defense
SA[stig-analyst]:::defense

RG[report-generator]:::report

EP --> OA --> OS
EP --> TM
OS --> RA --> VS
VS --> WH & AS & BL & BB & AD & CS & MP & WP & LR
SE --> PO
BB --> WH
PO --> PC --> C2
AD --> CR
AD --> PE
CS --> CB
CB --> PE
WH --> PV
AS --> PV
PV --> EC --> AP
EC --> EG
PC --> RE
RE --> MA
AP --> SO
C2 --> DE
SO --> RG
DE --> FA
MA --> RG
SA --> RG
CT -.solo.-> RG
CI -.pipeline.-> SO
root@kitploit:~
Los agentes de nivel 1 (asesoría) se pueden enrutar desde cualquier tarea. Los agentes de nivel 2 (con capacidad de ejecución) requieren un alcance declarado y residen en el clúster de operaciones ofensivas.

## Novedades en v3.1

- **3 nuevos agentes**: `payload-crafter` (msfvenom, Donut, cargadores personalizados), `reverse-engineer` (Ghidra, JadX, Radare2, Binwalk), `phishing-operator` (Evilginx, GoPhish, dnstwist)
- **Comandos slash**: `/recommend "freeform task"` te enruta al agente correcto + comandos concretos. `/agents-for <tag>` filtra el catálogo por dominio.
- **`db/doctor.sh`**: audita qué herramientas CLI subyacentes están instaladas en tu equipo, agrupadas por agente. Muestra `✔` y `✘` por herramienta con consejos de instalación.
- **`install.sh --tools`**: instalador opcional que incorpora las herramientas subyacentes mediante apt/brew/pacman + pipx/go/cargo.
- **Agentes ampliados**: Commix añadido a web-hunter, RouterSploit añadido a vuln-scanner, generación de wordlists específicas (cupp, CeWL, Mentalist, Crunch, hashid, haiti) añadida a credential-tester, kit de herramientas completo de esteganografía añadido a ctf-solver.

## Inicio rápido

Un solo comando:```bash
curl -fsSL https://raw.githubusercontent.com/0xSteph/pentest-ai-agents/main/install.sh | bash

Eso es todo. El script clona el repositorio en un directorio temporal, copia los agentes a ~/.claude/agents/ y sale. Idempotente: es seguro volver a ejecutarlo para obtener actualizaciones.

O instálalo como un plugin de Claude Code (sin clonar; actualizaciones a través del marketplace):``` /plugin marketplace add 0xSteph/pentest-ai-agents /plugin install pentest-ai-agents@pentest-ai-agents

root@kitploit:~
Esto registra los 52 agentes y los slash commands a través del sistema de plugins de Claude Code. Elige el plugin **o** el instalador — no necesitas ambos.

Luego abre Claude Code:```
"Plan an internal network pentest for a 500-endpoint AD environment with a 2-week window."

Claude se enruta al agente de planificación de compromisos y produce un plan por fases con asignaciones de MITRE ATT&CK.

¿Prefieres clonar primero?```bash git clone https://github.com/0xSteph/pentest-ai-agents.git cd pentest-ai-agents && ./install.sh --global

root@kitploit:~
**Otras opciones de instalación:**```bash
./install.sh --project     # Install for current project only
./install.sh --global --lite  # Use Haiku for advisory agents (lower cost)
./install.sh --tools       # Install underlying CLI tools (nmap, nuclei, ffuf, etc.)
./install.sh --help        # All options

See INSTALL.md para obtener instrucciones paso a paso, incluida la configuración inicial de Claude Code.


Hoja de referencia

Interacciones rápidas una vez instalado:

En Claude Code, basta con describir tu tarea y se enruta automáticamente:``` "Plan an internal pentest for a 500-endpoint AD environment, 2-week window." "I have a domain user, where do I look first in BloodHound?" "Convert this SharpHound EXE into shellcode for an EDR test, with detection content." "Reverse this firmware image and tell me what the cryptographic protocol looks like." "Run a phishing simulation against acme-corp.com, set up GoPhish + Evilginx infrastructure."

root@kitploit:~
---

## Coverage

Lo que impulsan los agentes. Las categorías se corresponden con la misma superficie sobre la que operan los adversarios reales:

| Categoría | Agentes | Herramientas subyacentes (instalables mediante `install.sh --tools`) |
|----------|--------|--------------------------------------------------------|
| **Reconocimiento y OSINT** | recon-advisor, osint-collector | nmap, masscan, rustscan, dig, whois, subfinder, amass, httpx, theHarvester, sherlock, holehe, maigret |
| **Escaneo de vulnerabilidades** | vuln-scanner | nuclei, nikto, RouterSploit, nmap NSE, análisis de resultados de OpenVAS/Nessus |
| **Pruebas de aplicaciones web** | web-hunter, api-security, bug-bounty, bizlogic-hunter | ffuf, gobuster, feroxbuster, sqlmap, dalfox, Commix, dirsearch, whatweb |
| **Active Directory** | ad-attacker, credential-tester | BloodHound, Impacket, NetExec/CrackMapExec, Certipy, kerbrute, Responder, ldapsearch |
| **Credenciales y cracking** | credential-tester, password-auditor | Hydra, Hashcat, John, Medusa, cupp, CeWL, auditoría de políticas NIST 800-63B, anonimato k de HIBP |
| **Nube** | cloud-security, cicd-redteam | aws/az/gcloud CLIs, Trivy, Prowler, ScoutSuite, Pacu |
| **Contenedores y breakout en K8s** | container-breakout | kubectl, kube-hunter, peirates, CDK, emparejamiento con reglas de Falco |
| **Operaciones C2** | c2-operator | Sliver, Mythic, Havoc, Cobalt Strike, perfiles malleable, diseño de redirectores |
| **Red teaming de IA / LLM** | ai-recon, llm-redteam | descubrimiento de superficie A2A/MCP/RAG, huella de modelo, Garak, PyRIT, Promptfoo, OWASP LLM Top 10, MITRE ATLAS |
| **Opsec del operador** | opsec-anonymizer | diseño de IP de origen, identidad desechable, higiene de JA3/huellas, listas de verificación de quema |
| **Móvil** | mobile-pentester, reverse-engineer | Frida, Objection, jadx, apktool, MobSF, adb |
| **Inalámbrico** | wireless-pentester | aircrack-ng, hcxdumptool, hcxtools, bettercap, wifite |
| **Ingeniería social** | social-engineer, phishing-operator | GoPhish, Evilginx, dnstwist, Modlishka |
| **Creación de payloads** | payload-crafter | msfvenom, Donut, MSFvenom Payload Creator, patrones de loaders personalizados |
| **Ingeniería inversa** | reverse-engineer, malware-analyst | Ghidra, Radare2, JadX, Binwalk, Apktool, IDA, dnSpy, Volatility 3 |
| **Forense y respuesta a incidentes (IR)** | forensics-analyst, malware-analyst | Volatility 3, exiftool, foremost, YARA, Wireshark/tshark, Autopsy |
| **Encadenamiento de exploits** | exploit-chainer, attack-planner, poc-validator | composición de ataques multi-paso, puntuación de cadenas mapeadas a ATT&CK |
| **Ataques a bases de datos** | database-attacker | sqlmap, NoSQLMap, clientes nativos (MySQL/PostgreSQL/MSSQL/Oracle/MongoDB/Redis) |
| **Red L2/L3 y tráfico** | network-attacker, traffic-analyzer | Responder, ntlmrelayx, mitm6, bettercap, Wireshark/tshark, Zeek |
| **Post-explotación** | lateral-movement, persistence-planner, evasion-specialist, data-exfiltrator | PtH/PtT, WMI/WinRM/DCOM, evasión de AMSI/ETW, exfiltración por DNS/HTTPS, golden ticket |
| **ICS / OT** | scada-attacker | Modbus, DNP3, S7comm, EtherNet/IP, OPC-UA, emparejamiento con IDS consciente de OT |
| **IoT / embebido** | iot-pentester | binwalk, UART/JTAG/SPI, BLE/Zigbee/sub-GHz, análisis de firmware |
| **Código seguro y criptografía** | code-auditor, crypto-analyzer | Semgrep, CodeQL, gitleaks, testssl.sh, jwt_tool |
| **Detección y defensa** | detection-engineer, threat-modeler, stig-analyst | Sigma, Splunk SPL, Elastic KQL, Sentinel KQL, STRIDE/DREAD, DISA STIG |
| **CTF** | ctf-solver | zsteg, steghide, stegseek, pngcheck, más cadena de herramientas genérica |
| **Reportes, riesgo y cumplimiento** | engagement-planner, report-generator, risk-scorer, compliance-mapper | mapeo MITRE ATT&CK, CVSS 3.1/4.0, EPSS, CISA KEV, mapeo PCI/NIST/ISO/CIS |

Ejecuta `bash db/doctor.sh` para ver cuáles de estas herramientas están presentes en tu equipo ahora mismo y cuáles faltan.

---

## Agentes

### Operaciones Ofensivas

| Agente | Qué hace |
|-------|-------------|
| **Engagement Planner** | Planes de pentest por fases con mapeos MITRE ATT&CK, estimaciones de tiempo y plantillas de ROE |
| **Recon Advisor** | Analiza la salida de Nmap/Nessus/BloodHound, prioriza objetivos, recomienda próximos comandos. *Nivel 2: ejecuta herramientas de reconocimiento directamente.* |
| **OSINT Collector** | Reconocimiento de dominios, recolección de correos electrónicos, perfilado en redes sociales, análisis de datos de filtraciones |
| **Exploit Guide** | Metodología de ataque para AD, web, nube y post-explotación con perspectiva defensiva |
| **Privilege Escalation** | Escalada de privilegios en Linux y Windows: SUID, tokens, servicios, exploits de kernel, escape de contenedores |
| **Cloud Security** | Pentesting en AWS/Azure/GCP: escalada de IAM, escape de contenedores, explotación serverless |
| **API Security** | Pruebas de REST, GraphQL, WebSocket. OWASP API Top 10, ataques JWT, explotación de OAuth |
| **Mobile Pentester** | Análisis de Android/iOS con Frida, Objection, jadx. Mapeo OWASP MASTG/MASVS |
| **Wireless Pentester** | WPA/WPA2/WPA3, evil twin, AP rogue, 802.1X empresarial, seguridad Bluetooth |
| **Social Engineer** | Campañas de phishing, pretexting, vishing para compromisos de red team autorizados |
| **Vuln Scanner** | Escaneos con Nuclei, Nikto, Nmap NSE. Analiza resultados de Nessus/OpenVAS. *Nivel 2: ejecuta escaneos.* |
| **Web Hunter** | ffuf, gobuster, sqlmap, dalfox. Descubrimiento de contenido, fuzzing, detección de WAF. *Nivel 2: ejecuta herramientas web.* |
| **Credential Tester** | Hydra, Hashcat, John, CrackMapExec. Identificación de hashes, generación de wordlists |
| **Attack Planner** | Correlaciona hallazgos en cadenas de ataque multi-paso. Puntúa por probabilidad, sigilo e impacto |
| **Supply Chain Auditor** | Inventario SBOM, exposición a dependency confusion y typosquatting, revisión de install-hooks, integridad de lockfiles y procedencia |
| **Bug Bounty Hunter** | Metodología HackerOne/Bugcrowd, evasión de duplicados, redacción de reportes para maximizar recompensas |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy. Kerberos, delegación, ACL y abuso de certificados. *Nivel 2: ejecuta herramientas de AD.* |
| **Exploit Chainer** | Encadena hallazgos de baja severidad en rutas de compromiso completas. Paso a paso con puntos de aprobación. *Nivel 2.* |
| **PoC Validator** | Genera y ejecuta de forma segura scripts de prueba de concepto. Elimina falsos positivos. *Nivel 2.* |
| **Payload Crafter** | msfvenom, Donut, loaders personalizados. Empareja cada payload con contenido de detección YARA/Sigma. |
| **Reverse Engineer** | Ghidra, JadX, Radare2, Binwalk. Análisis estático de firmware, aplicaciones móviles y binarios. |
| **Phishing Operator** | Infraestructura con Evilginx, GoPhish, dnstwist. Herramientas de campañas en vivo para red team autorizado. |
| **Swarm Orchestrator** | Coordina a todos los agentes como un enjambre de red team. Flujos de trabajo paralelos, seguimiento del progreso. |
| **Business Logic Hunter** | Manipulación de precios, bypass de flujos de trabajo, condiciones de carrera, fallos de autorización. *Nivel 2.* |
| **CI/CD Red Team** | GitHub Actions, GitLab CI, configuraciones de pipeline en Jenkins con puertas de seguridad |
| **C2 Operator** | Sliver, Mythic, Havoc, Cobalt Strike. Ajuste de listeners, higiene de beacons, diseño de redirectores, quema de compromiso |
| **Container Breakout** | Escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC, bypass del admission controller |
| **OpSec Anonymizer** | Higiene de identidad del operador, estrategia de IP de origen, infraestructura desechable, higiene de huellas de navegador/JA3 |
| **LLM Red Team** | Pruebas OWASP LLM Top 10, inyección de prompts, envenenamiento de RAG, abuso de herramientas de agentes, explotación de servidores MCP |
| **AI Recon** | Mapea la superficie de ataque de IA: endpoints de IA/LLM, tarjetas de agente A2A, exposición de MCP, superficie de RAG/herramientas, huella del modelo. *Nivel 2: ejecuta reconocimiento de solo lectura.* |
| **Password Auditor** | Auditoría de políticas NIST 800-63B + almacenamiento de hashes, exposición en filtraciones (anonimato k de HIBP), planificación de spray seguro contra bloqueos |
| **Database Attacker** | Profundidad de inyección SQL/NoSQL, escalada de privilegios en BD, extracción acotada a prueba en los principales motores. *Nivel 2.* |
| **Network Attacker** | Envenenamiento LLMNR/NBT-NS, relay NTLM, mitm6, MITM ARP, pivoting. *Nivel 2: ejecuta ataques L2/L3.* |
| **Evasion Specialist** | Evasión de AV/EDR, bypass de AMSI/ETW, ejecución en memoria: cada técnica emparejada con su detección |
| **Persistence Planner** | Persistencia en host/AD/nube (golden ticket, WMI, servicios) con seguimiento obligatorio de limpieza + detección |
| **Data Exfiltrator** | Exfiltración por DNS/HTTPS/ICMP y pruebas de DLP/egress con datos sintéticos/canarios, emparejadas con detección |
| **SCADA Attacker** | Análisis de protocolos ICS/OT (Modbus/DNP3/S7comm/OPC-UA), con compuertas de seguridad, pasivo primero |
| **IoT Pentester** | Firmware, interfaces de hardware (UART/JTAG), radio (BLE/sub-GHz) y pruebas dispositivo-nube |
| **Lateral Movement** | PtH/PtT, WMI/WinRM/DCOM/SSH, robo de tokens, planificación de pivoting, emparejado con detección |

### Defensa y Análisis

| Agente | Qué hace |
|-------|-------------|
| **Fix Verifier** | Vuelve a probar un hallazgo después de un parche. Reproduce la prueba original, prueba la clase, no la cadena, y marca correcciones parciales y regresiones |
| **Detection Engineer** | Reglas Sigma, Splunk SPL, Elastic KQL, Sentinel KQL con ajuste de falsos positivos |
| **Threat Modeler** | Análisis STRIDE/DREAD, árboles de ataque, diagramas de flujo de datos |
| **Forensics Analyst** | Adquisición de evidencia, forense de memoria, análisis de disco, construcción de líneas de tiempo |
| **Malware Analyst** | Análisis estático/dinámico, ingeniería inversa, reglas YARA, extracción de IOC |
| **STIG Analyst** | Cumplimiento DISA STIG, rutas de remediación de GPO, plantillas de justificación de excepciones |
| **Code Auditor** | Revisión de código seguro: inyección, autorización, secretos, deserialización (Semgrep, CodeQL, gitleaks) |
| **Crypto Analyzer** | Algoritmos/modos débiles, manejo de claves y IV/nonce, configuración TLS/certificados, problemas de tokens JWT/JWE |
| **Traffic Analyzer** | Análisis de pcap offline: disección de protocolos, extracción de credenciales, búsqueda de beacons/anomalías |

### Reportes y Aprendizaje

| Agente | Qué hace |
|-------|-------------|
| **Report Generator** | Reportes profesionales de pentest con resúmenes ejecutivos, puntuación CVSS, hojas de ruta de remediación |
| **CTF Solver** | HackTheBox, TryHackMe, PicoCTF. Web, pwn, rev, crypto, forense, OSINT |
| **Compliance Mapper** | Mapea hallazgos a PCI DSS, NIST 800-53/CSF, ISO 27001, CIS, HIPAA, SOC 2 con análisis de brechas de controles |
| **Risk Scorer** | Vectores CVSS 3.1/4.0, enriquecimiento con EPSS + CISA KEV, priorización de remediación según contexto de negocio |

---

## Nivel 1 vs Nivel 2

**Nivel 1 (todos los agentes):** Modo asesor. Pegas la salida de las herramientas, haces preguntas de metodología, recibes análisis y recomendaciones. Las herramientas las ejecutas tú mismo.

**Nivel 2 (agentes seleccionados):** También pueden componer y ejecutar comandos directamente. Declaras tu alcance autorizado, el agente valida cada objetivo contra ese alcance, y Claude Code te muestra cada comando para que lo apruebes antes de ejecutarlo.

| Agente de Nivel 2 | Qué ejecuta |
|-------|-----------------|
| **Recon Advisor** | nmap, dig, whois, curl, netcat, traceroute, whatweb, nikto |
| **Vuln Scanner** | nuclei, nikto, scripts NSE de nmap |
| **Web Hunter** | ffuf, gobuster, feroxbuster, sqlmap, dalfox, whatweb |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy, ldapsearch, enum4linux |
| **Exploit Chainer** | Ejecución de cadenas multi-paso con aprobación en cada compuerta |
| **PoC Validator** | Scripts de prueba de concepto seguros y no destructivos |
| **Business Logic Hunter** | Pruebas de fallos lógicos (manipulación de precios, condiciones de carrera) |
| **AI Recon** | Descubrimiento de endpoints de IA, sondeos de /v1/models, enumeración A2A/MCP (solo lectura) |
| **Database Attacker** | sqlmap, NoSQLMap, clientes nativos de BD (acotados a prueba, no destructivos) |
| **Network Attacker** | Responder, ntlmrelayx, mitm6, bettercap (posicionamiento L2/L3 acotado) |
| **CI/CD Red Team** | Escaneos SAST/DAST/secretos impulsados por pipelines contra objetivos dentro del alcance |

Consulta [docs/TIER2-EXECUTION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md) para conocer el modelo de seguridad completo.

---

## Ejemplos```
$ claude

You: Analyze this Nmap scan and prioritize targets for our internal pentest

> Routing to recon-advisor agent...

## Prioritized Target Summary

### Critical Priority
| Host       | Port | Service | Finding                  |
|------------|------|---------|--------------------------|
| 10.10.1.5  | 445  | SMB     | SMBv1 enabled, MS17-010  |
| 10.10.1.20 | 3389 | RDP     | BlueKeep (CVE-2019-0708) |

### Recommended Next Steps
1. nmap -sV --script smb-vuln* 10.10.1.5
2. crackmapexec smb 10.10.1.0/24
3. bloodhound-python -d corp.local

Más ejemplos en el directorio examples/:


Ejecutar herramientas en un contenedor

Ejecute sus herramientas de seguridad dentro de un contenedor Docker para mantener su estación de trabajo limpia y evitar las alertas de protección de endpoints.```bash docker pull kalilinux/kali-rolling docker run -it --name pentest-lab kalilinux/kali-rolling /bin/bash apt update && apt install -y nmap nikto sqlmap metasploit-framework bloodhound

root@kitploit:~
Usa agentes pentest-ai en tu host para metodología y análisis. Ejecuta las herramientas reales dentro del contenedor.

---

## Base de datos de hallazgos

Almacenamiento SQLite persistente que conserva los datos del engagement a lo largo de las sesiones de Claude Code.```bash
findings.sh init acme-2024 --client "ACME Corp" --type internal --scope "10.0.0.0/24"
export PENTEST_AI_ENGAGEMENT="acme-2024"

findings.sh stats         # Check progress
findings.sh list vulns    # See all findings
findings.sh export        # Full JSON export
bash handoff.sh           # Markdown handoff report for next session

Los agentes de nivel 2 escriben en la base de datos automáticamente cuando findings.sh está en PATH. Consulta docs/FINDINGS-DB.md para la documentación completa.


Optimización de tokens

Instala con el modo lite para ejecutar agentes de asesoramiento en Haiku (menor costo, misma metodología):```bash ./install.sh --global --lite

root@kitploit:~
Consulta [docs/TOKEN-OPTIMIZATION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) para la guía completa.

---

## Modelos Locales

Los agentes son prompts de sistema en markdown simple — la única parte específica de Claude es el encabezado frontmatter YAML. Se ejecutan en cualquier modelo: apunta Claude Code a cualquier endpoint compatible con Anthropic configurando `ANTHROPIC_BASE_URL`, o copia el prompt de sistema (todo lo que está debajo del frontmatter) en cualquier ejecutor local como Ollama o LM Studio.

Consulta [docs/LOCAL-SETUP.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) para notas sobre modelos locales.

---

## Documentación

| Documento | Descripción |
|----------|-------------|
| [INSTALL.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/INSTALL.md) | Guía de instalación con solución de problemas |
| [Agent Guide](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/AGENT-GUIDE.md) | Cómo funciona cada agente y cuándo usarlo |
| [Tier 2 Execution](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md) | Modelo de seguridad del modo de ejecución y guía de conversión |
| [Local Setup](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) | Ejecuta sin conexión con Ollama y GPU local |
| [Customization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/CUSTOMIZATION.md) | Modifica agentes, cambia modelos, crea nuevos agentes |
| [Token Optimization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) | Reduce el consumo de tokens |
| [Findings Database](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/FINDINGS-DB.md) | Almacenamiento persistente SQLite para datos de engagement |
| [Data Privacy](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/DATA-PRIVACY.md) | Manejo de datos de LLM y opciones de modelos locales |
| [Changelog](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/CHANGELOG.md) | Historial de versiones |

---

## Servidor MCP

¿Buscas el pipeline automatizado? **[pentest-ai](https://github.com/0xSteph/pentest-ai)** es el servidor MCP complementario con más de 150 wrappers de herramientas, encadenamiento autónomo de exploits e integración CI/CD. Funciona con Claude Desktop, Cursor, VS Code Copilot y cualquier cliente MCP.

---

## Requisitos previos

- [Claude Code](https://docs.anthropic.com/en/docs/claude-code) instalado y configurado
- Suscripción a Claude Pro o Max
- Para pruebas de seguridad: reglas de compromiso firmadas y alcance definido

---

## Aviso legal

Este kit de herramientas es solo para **pruebas de seguridad autorizadas**. Los usuarios deben contar con la autorización escrita correspondiente antes de usar estos agentes en cualquier engagement. Consulta [DISCLAIMER.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/DISCLAIMER.md) para conocer los términos completos.

---

## Licencia

[Licencia MIT](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/LICENSE)

---

<div align="center">

Creado por [0xSteph](https://github.com/0xSteph) &middot; [pentestai.xyz](https://pentestai.xyz)

</div>
Descargar herramienta
persistence-planner
data-exfiltrator
scada-attacker
iot-pentester
lateral-movement
  • Validador CI reforzado. Un flujo de trabajo de mínimos privilegios y con hash SHA fijado valida el frontmatter de cada agente, exige el bloque de protección de alcance en todo agente con capacidad Bash (Nivel 2), comprueba los manifiestos del plugin y realiza pruebas de humo al instalador.
  • Brecha del protector de alcance cerrada. cicd-redteam tenía capacidad Bash pero le faltaba el bloque obligatorio de aplicación de alcance; ahora está corregido (la nueva comprobación CI lo habría detectado).
  • Correcciones del instalador. curl | bash ya no falla con set -u, la URL de clonado de una línea está corregida, los comandos slash ahora se instalan junto con los agentes, y --uninstall elimina todo limpiamente.
  • Paquete Docker offline mínimo con imagen base de digest fijado y usuario no root — solo empaquetado, sin herramientas incluidas.
  • ComandoQué hace
    /recommend "phish a small SaaS team's IT department"Selecciona el agente adecuado y da los siguientes comandos concretos
    /agents-for webLista todos los agentes relevantes para pruebas web (web-hunter, api-security, bug-bounty, bizlogic-hunter)
    /agents-for cloudAgentes específicos de la nube (cloud-security, cicd-redteam)
    db/doctor.shAudita qué herramientas CLI subyacentes tienes, agrupadas por agente. Muestra ✔/✘ y sugerencias de instalación.
    db/doctor.sh --agent ad-attackerAudita solo la pila de herramientas de AD
    db/doctor.sh --jsonSalida legible por máquina para canalizar a un script
    install.sh --toolsInstala las herramientas subyacentes mediante tu gestor de paquetes + pipx/go/cargo
    findings.sh init <id>Inicia un nuevo encargo (base de datos de hallazgos SQLite persistente)
    findings.sh statsProgreso del encargo
    findings.sh exportExportación JSON completa
    bash handoff.shInforme de traspaso Markdown entre sesiones
    EjemploAgenteLo que muestra
    Engagement Planengagement-plannerPlan por fases completo con mapeos MITRE ATT&CK
    Nmap Analysisrecon-advisorVectores de ataque priorizados con comandos de seguimiento
    Detection Ruledetection-engineerDetección de Kerberoasting en Sigma, SPL y KQL
    STIG Findingstig-analystAnálisis STIG con ruta de GPO y plantilla keep-open
    Report Excerptreport-generatorHallazgo de inyección SQL formateado para un informe de pentest