
Proyecto OWASP de Playbook de Agentes Seguros
Un playbook de seguridad de código abierto para agentes de IA. Procedimientos estructurados basados en OWASP que permiten a los agentes realizar tareas de ingeniería de seguridad, desde revisiones de código hasta auditorías de seguridad de agentes de IA.
Sin un playbook, pedirle a un agente de IA que "revise mi código por seguridad" te da una lista de verificación superficial. Con estos plays, el agente sigue un procedimiento estructurado basado en OWASP, probando sistemáticamente cada clase de vulnerabilidad, generando hallazgos con mapeos CWE, referencias cruzadas OpenCRE, fragmentos de evidencia y código de remediación específico.
Esto no es un framework ni una biblioteca. No hay código que importar.
Cada play es un procedimiento de seguridad paso a paso con listas de verificación, criterios de decisión y plantillas de salida. Un agente de IA sigue el procedimiento para producir hallazgos consistentes y basados en evidencia. Piénsalo como el playbook de un analista SOC, pero escrito para que lo ejecuten agentes de IA.
Con Claude Code (recomendado):
Paso 1 — Registra el marketplace de plugins:
/plugin marketplace add OWASP/secure-agent-playbook
Paso 2 — Instala un conjunto de habilidades:
/plugin install code-security-skills@agent-security-playbook
/plugin install ai-security-skills@agent-security-playbook
Paso 3 — Usa las habilidades mencionando la tarea en la conversación:
"Revisa este código en busca de problemas de seguridad"
"Escanea mis dependencias en busca de CVE"
"Audita esta configuración de servidor MCP"
"Prueba este chatbot contra inyección de prompts"
Claude activará automáticamente la habilidad relevante según el contexto. Consulta Catálogo de Habilidades para todas las habilidades disponibles y Ejemplo de Salida para ver cómo se ven los resultados.
Plugin para la organización — Para administradores de organizaciones de Claude que instalan mediante Organization Plugins:
secure-agent-playbook.zip de los activos de la versiónNota: No uses el botón "Download ZIP" de GitHub — anida archivos en un subdirectorio que el validador de plugins rechaza. Usa siempre el zip de los activos de la versión.
Desarrollo local — Para probar desde un clon local en lugar de GitHub:
/plugin marketplace add /path/to/agent-security-playbook
/plugin install code-security-skills@agent-security-playbook
/plugin install ai-security-skills@agent-security-playbook
Sin Claude Code:
Consulta los plays directamente como procedimientos para cualquier agente de IA o uso manual:
plugins/ai-security-skills/plays/agent-security-audit.md"code-security-skills)ai-security-skills)Los agentes son especialistas de seguridad autónomos que invocan habilidades y producen informes estructurados. Cada agente tiene un prompt de sistema enfocado, acceso a herramientas limitado y habilidades precargadas. Úsalos individualmente o como equipo coordinado.
Uso independiente — invoca cualquier agente directamente:
"Usa code-security-reviewer para revisar src/"
"Usa dependency-auditor para escanear este proyecto"
Evaluación en equipo — con equipos de agentes habilitados, el líder del equipo despacha especialistas en paralelo y consolida los hallazgos en un solo informe:
"Ejecuta una evaluación de seguridad completa de este proyecto"
El líder del equipo delimita el objetivo, despacha especialistas relevantes (saltándose aquellos cuyo enfoque no está presente), deduplica hallazgos, identifica cadenas de riesgo entre dominios y produce un informe unificado usando templates/report.md.
Los equipos de agentes requieren
CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1. Consulta la documentación de Claude Code para la configuración. Los agentes individuales funcionan sin esta bandera.
Ejecutar "Revisa src/auth/ en busca de problemas de seguridad" en un código base Node.js/Express produce hallazgos como estos:
Security Code Review — src/auth/
Scope: Node.js/Express, server-side, processes user credentials
Findings: CRITICAL 1 | HIGH 2 | MEDIUM 1 | LOW 0
src/auth/login.js:42id manipulado// src/auth/login.js:42
const user = await db.query("SELECT * FROM users WHERE id=" + req.params.id);
const user = await db.query("SELECT * FROM users WHERE id = $1", [req.params.id]);
Cada habilidad produce hallazgos estructurados con severidad, CWE, evidencia y código de remediación. Consulta
examples/para informes de evaluación de muestra completos.
El diferenciador: procedimientos de seguridad diseñados específicamente para la era de los agentes de IA. Incluidos dentro del plugin ai-security-skills.
Valor práctico inmediato para cualquier código base. Incluidos dentro del plugin code-security-skills.
Diseño de tres capas: cada capa vive dentro de la carpeta fuente del plugin para que la instalación del marketplace incluya todo lo que las habilidades necesitan:
plugins/<name>/agents/ — Especialistas de seguridad autónomos con prompts de sistema enfocados, ubicados dentro de cada plugin. Cada agente invoca una o más habilidades, opera en un contexto aislado y produce informes estructurados. Puede trabajar solo o como un equipo coordinado.plugins/<name>/skills/ — Archivos SKILL.md autocontenidos que siguen la especificación Agent Skills. Distribuidos a través de plugins/code-security-skills/ y plugins/ai-security-skills/, registrados en el marketplace mediante .claude-plugin/marketplace.json. Cada habilidad resume un procedimiento y referencia su play correspondiente dentro del mismo plugin.plugins/<name>/plays/ — Procedimientos de referencia completos con listas de verificación detalladas, tablas, criterios de decisión y ejemplos. Las habilidades hacen referencia a estos para una cobertura exhaustiva.plugins/<name>/templates/ y plugins/<name>/data/ — Plantillas de salida (finding.md, ) y conjuntos de datos de referencia OWASP (FIASSE v1.0.4, ASVS v5.0, prompts de código seguro) que las habilidades cargan en tiempo de ejecución.Los agentes orquestan, las habilidades ejecutan, los plays proporcionan el procedimiento completo. Los contribuyentes editan los plays. Esto significa que el playbook funciona con cualquier agente de IA (solo apúntalo a un play), mientras que los usuarios de Claude Code obtienen instalación basada en plugins con agentes y habilidades.
Todos los plays hacen referencia a estándares y conjuntos de datos de OWASP:
Consulta CONTRIBUTING.md para obtener pautas detalladas.
Los nuevos plays deben:
templates/finding.md dentro del pluginplays/ del plugin correspondiente para que se incluyan en la instalación del marketplaceLicenciado bajo Creative Commons Attribution 4.0 International (CC-BY-4.0). Consulta THIRD_PARTY_NOTICES.md para la atribución del contenido de proyectos upstream de OWASP.
| Habilidad | Qué Hace | Di Esto | Ref. OWASP |
|---|
code-review-security | Revisión de seguridad de código mapeada a Top 10 + ASVS | "Revisa este código en busca de problemas de seguridad" | Top 10, ASVS |
sca-audit | Escaneo de CVE en dependencias con análisis de alcanzabilidad | "Escanea mis dependencias en busca de CVE" | A06:2021 |
secrets-scan | Detecta credenciales hardcodeadas y claves API | "Escanea en busca de secretos hardcodeados" | CWE-798 |
api-security-review | Revisión de API contra OWASP API Top 10 (2023) | "Revisa esta API por seguridad" | API Top 10 |
web-security-review | Revisión de aplicación web contra OWASP Top 10 (2021) | "Revisa esta app web por OWASP Top 10" | Top 10 |
mobile-code-review | Revisión de código fuente nativo Android/iOS contra OWASP MASVS v2.1.0 | "Revisa esta app móvil por seguridad" | MASVS v2.1.0 |
iac-security-review | Seguridad en IaC (Terraform, K8s, CloudFormation) | "Revisa este Terraform por seguridad" | CIS Benchmarks |
securability-engineering | Genera código inherentemente asegurable (FIASSE v1.0.4) | "Genera código seguro para..." | FIASSE v1.0.4 |
securability-engineering-review | Evalúa la asegurabilidad del código (puntuación SSEM 0-10) | "Evalúa la asegurabilidad de este código" | FIASSE v1.0.4/SSEM |
prd-securability-enhancement | Fortalece PRDs/especificaciones con cobertura ASVS y requisitos SSEM de FIASSE antes de escribir código | "Fortalece este PRD" / "Mapa características a ASVS" | ASVS, FIASSE v1.0.4 |
security-guidance | Orientación ASVS activada automáticamente para código sensible a la seguridad | (auto-activado) | ASVS 5.0 |
| Habilidad | Qué Hace | Di Esto | Ref. OWASP |
|---|
agent-security-audit | Audita permisos del agente, superficies de inyección, rutas de exfiltración de datos | "Audita la seguridad de este agente" | LLM Top 10 |
llm-risk-assess | Evaluación de aplicación LLM contra LLM Top 10 2025 | "Evalúa los riesgos LLM para esta app" | LLM Top 10 |
agentic-ai-risk-assess | Evaluación de aplicación agentica contra Top 10 Agentic 2026 | "Evalúa los riesgos de IA agéntica" | Agentic Top 10 |
mcp-server-review | Revisión de seguridad de servidor MCP | "Revisa este servidor MCP" | LLM Top 10 |
prompt-injection-test | Pruebas de inyección de prompts (Taxonomía Arcanum PI) | "Prueba la inyección de prompts" | LLM01 |
multi-agentic-threat-model | Modelado de amenazas CSA MAESTRO de 7 capas | "Modela amenazas para este sistema multi-agente" | CSA MAESTRO |
| Agente | Enfoque | Habilidades Invocadas |
|---|
code-security-reviewer | Vulnerabilidades de código, secretos, seguridad web | code-review-security, secrets-scan, web-security-review |
dependency-auditor | Riesgos de cadena de suministro y CVE en dependencias | sca-audit |
api-security-reviewer | Seguridad de API contra OWASP API Top 10 | api-security-review |
mobile-security-reviewer | Código fuente nativo Android/iOS contra OWASP MASVS v2.1.0 | mobile-code-review |
ai-security-assessor | Configuraciones de agente, servidores MCP, riesgos de app LLM | agent-security-audit, mcp-server-review, llm-risk-assess, prompt-injection-test |
security-team-lead | Coordina especialistas, consolida informe | securability-engineering-review |
| Play | Qué Hace |
|---|
| agent-security-audit | Audita permisos del agente, superficies de inyección de prompts, rutas de exfiltración de datos, barreras de protección |
| agentic-ai-risk-assess | Evalúa aplicaciones de IA agéntica contra OWASP Top 10 para Aplicaciones Agenticas 2026 |
| ai-security-verification | Verifica aplicaciones impulsadas por IA contra el Estándar de Verificación de Seguridad de IA de OWASP (AISVS) |
| llm-risk-assess | Evalúa aplicaciones LLM contra OWASP Top 10 para Aplicaciones LLM |
| mcp-server-review | Revisa implementaciones de servidores MCP por sobrepermisos, inyección, exposición de datos |
| multi-agentic-threat-model | Modela amenazas de sistemas multi-agente usando el marco CSA MAESTRO de 7 capas y la Guía de Sistemas Multi-Agente de OWASP v1.0 |
| prompt-injection-testing | Prueba apps LLM contra 18 técnicas de ataque, 20 evasiones, 13 intenciones |
| Play | Qué Hace |
|---|
| sca-audit | Escanea dependencias en busca de CVE conocidos con análisis de alcanzabilidad |
| code-review-security | Revisión de seguridad de código sistemática mapeada a OWASP Top 10 y ASVS |
| secrets-scan | Detecta credenciales hardcodeadas, claves API y tokens |
| api-security-review | Revisa APIs contra OWASP API Security Top 10 |
| owasp-top10-web-review | Revisión de aplicación web contra OWASP Top 10 (2021) |
| mobile-code-review | Revisión de código fuente nativo Android/iOS contra OWASP MASVS v2.1.0 |
| iac-security-review | Revisa Terraform, Kubernetes, CloudFormation contra benchmarks CIS y mejores prácticas de seguridad en la nube |
| securability-engineering-review | Evalúa el código contra atributos asegurables de FIASSE v1.0.4/SSEM: Mantenibilidad, Confiabilidad, Fiabilidad y Transparencia |
report.md| Proyecto | Relación |
|---|
| OWASP Agent Skills Project | Orientación proactiva ASVS 5.0 para agentes de IA de codificación: ayuda a los agentes a escribir código seguro. Usamos sus datos de referencia ASVS en plugins/code-security-skills/data/asvs/. Complementarios: ellos guían la generación de código, nosotros encontramos vulnerabilidades en código existente. |
| Securability Engineering | Generación de código asegurable (OWASP FIASSE) y requisitos de código seguro (ASVS) mediante análisis de archivos de especificación y restricción de generación (evaluado y ajustado) para varias herramientas de generación de código IA. |
| Arcanum PI Taxonomy | Clasificación de ataques de inyección de prompts por Jason Haddix. Nuestro play prompt-injection-testing está construido sobre esta taxonomía. CC BY 4.0. |
| OpenCRE | Mapeos de requisitos entre estándares (CWE, ASVS, WSTG, NIST 800-53). Usamos enlaces OpenCRE en los hallazgos para trazabilidad multi-framework. |