Volver a actualizaciones
Nuevo releaseAug 5, 2026

pentest-ai-agents v3.4.0

Convierte Claude Code en tu asistente de investigación de seguridad ofensiva. Subagentes de IA especializados para planificar proyectos de pruebas de penetración autorizadas, analizar el reconocimiento, investigar exploits, crear detecciones, auditar STIGs y redactar informes.

Compartir

pentest-ai-agents

50 subagentes de Claude Code para pruebas de penetración.

License: MIT Claude Code Agents Tools Tracked GitHub stars

Inicio rápido | Hoja de referencia | Cobertura | Agentes | Ejemplos


Tabla de contenidos


pentest-ai-agents es una colección de 50 subagentes de Claude Code que convierten a Claude en un asistente de investigación ofensiva de seguridad. Cada agente lleva un profundo conocimiento de dominio en un área específica: reconocimiento, web, Active Directory, nube, móvil, inalámbrico, ingeniería social, creación de payloads, ingeniería inversa, encadenamiento de exploits, ingeniería de detección, forense digital y más.

Instala los archivos de agentes. Abre Claude Code. Describe tu tarea. Claude enruta automáticamente al especialista correcto.

Sin servidores, sin dependencias de Python, sin configuración más allá de copiar archivos.

Novedades en v3.3

  • Instalable como plugin de Claude Code. Dos líneas: /plugin marketplace add 0xSteph/pentest-ai-agents y luego /plugin install pentest-ai-agents@pentest-ai-agents. La ruta curl de install.sh sigue funcionando sin cambios.
  • 15 agentes nuevos (35 → 50): ai-recon (mapeo de superficie de ataque de IA), code-auditor, crypto-analyzer, password-auditor, database-attacker, network-attacker, traffic-analyzer, compliance-mapper, risk-scorer, además del conjunto de post-explotación: evasion-specialist, persistence-planner, data-exfiltrator, scada-attacker, iot-pentester, lateral-movement. Cada agente ofensivo combina sus técnicas con la detección que ejercitan.
  • Validador CI reforzado. Un flujo de trabajo de mínimos privilegios y con hash SHA fijado valida el frontmatter de cada agente, exige el bloque de protección de alcance en todo agente con capacidad Bash (Nivel 2), comprueba los manifiestos del plugin y realiza pruebas de humo al instalador.
  • Brecha del protector de alcance cerrada. cicd-redteam tenía capacidad Bash pero le faltaba el bloque obligatorio de aplicación de alcance; ahora está corregido (la nueva comprobación CI lo habría detectado).
  • Correcciones del instalador. curl | bash ya no falla con set -u, la URL de clonado de una línea está corregida, los comandos slash ahora se instalan junto con los agentes, y --uninstall elimina todo limpiamente.
  • Paquete Docker offline mínimo con imagen base de digest fijado y usuario no root — solo empaquetado, sin herramientas incluidas.

Novedades en v3.2

  • 4 agentes nuevos: c2-operator (ajuste de perfiles de Sliver/Mythic/Havoc/Cobalt Strike, higiene de beacons, diseño de redirectores), container-breakout (escape de Docker/K8s, CVEs de runc/cri-o, explotación de kubelet, abuso de RBAC), opsec-anonymizer (higiene de identidad del operador, diseño de IP de origen, infraestructura desechable, higiene de huellas), llm-redteam (pruebas del Top 10 de OWASP LLM, inyección de prompts, envenenamiento de RAG, abuso de servidores MCP, abuso de herramientas de agentes).
  • Protector de alcance reforzado: lista explícita de rechazo en _scope-guard.md cubre DoS, escaneo masivo, gusanos no supervisados, operaciones de bandera falsa y sistemas críticos de seguridad de vidas.
  • Base de datos de hallazgos v2: columna vulns.tool_used para filtrar hallazgos por la herramienta que los produjo; nuevos índices en cve y tool_used. Las interacciones existentes migran mediante db/migrate.sh.
  • Diagrama de mapa de agentes: flujo visual desde reconocimiento hasta cierre mapeado a nombres de agentes (ver más abajo).

Mapa de agentes```mermaid

flowchart LR classDef plan fill:#1a2a4a,stroke:#5a7ab8,color:#eaf0ff classDef recon fill:#1a3a2a,stroke:#5ab87a,color:#eaffea classDef exploit fill:#3a1a1a,stroke:#b85a5a,color:#ffeaea classDef post fill:#3a2a1a,stroke:#b8895a,color:#fff0ea classDef defense fill:#1a3a3a,stroke:#5ab8b8,color:#eaffff classDef report fill:#2a1a3a,stroke:#895ab8,color:#f0eaff

EP[engagement-planner]:::plan
OA[opsec-anonymizer]:::plan
TM[threat-modeler]:::plan

OS[osint-collector]:::recon
RA[recon-advisor]:::recon
VS[vuln-scanner]:::recon

WH[web-hunter]:::exploit
AS[api-security]:::exploit
BL[bizlogic-hunter]:::exploit
BB[bug-bounty]:::exploit
AD[ad-attacker]:::exploit
CS[cloud-security]:::exploit
MP[mobile-pentester]:::exploit
WP[wireless-pentester]:::exploit
LR[llm-redteam]:::exploit
SE[social-engineer]:::exploit
PO[phishing-operator]:::exploit
CT[ctf-solver]:::exploit
CR[credential-tester]:::exploit
PV[poc-validator]:::exploit
EG[exploit-guide]:::exploit
EC[exploit-chainer]:::exploit
AP[attack-planner]:::exploit
PC[payload-crafter]:::exploit
RE[reverse-engineer]:::exploit

PE[privesc-advisor]:::post
CB[container-breakout]:::post
C2[c2-operator]:::post
CI[cicd-redteam]:::post
SO[swarm-orchestrator]:::post

DE[detection-engineer]:::defense
FA[forensics-analyst]:::defense
MA[malware-analyst]:::defense
SA[stig-analyst]:::defense

RG[report-generator]:::report

EP --> OA --> OS
EP --> TM
OS --> RA --> VS
VS --> WH & AS & BL & BB & AD & CS & MP & WP & LR
SE --> PO
BB --> WH
PO --> PC --> C2
AD --> CR
AD --> PE
CS --> CB
CB --> PE
WH --> PV
AS --> PV
PV --> EC --> AP
EC --> EG
PC --> RE
RE --> MA
AP --> SO
C2 --> DE
SO --> RG
DE --> FA
MA --> RG
SA --> RG
CT -.solo.-> RG
CI -.pipeline.-> SO
Los agentes de nivel 1 (asesoría) se pueden enrutar desde cualquier tarea. Los agentes de nivel 2 (con capacidad de ejecución) requieren un alcance declarado y residen en el clúster de operaciones ofensivas.

## Novedades en v3.1

Categorías