
Kit de seguridad para agentes de IA empresarial que proporciona auditoría previa al vuelo, endurecimiento de configuración, detección de amenazas en tiempo de ejecución y defensa activa contra la inyección de prompts y la desviación de intenciones mediante módulos impulsados por SKILL.md.
Kit de Seguridad Empresarial para Agentes de IA - Defensa Activa Impulsada por SKILL.md
¡La defensa principal de ClawGuard v3 no está en el código, sino en SKILL.md!
El SKILL.md de cada módulo es en sí mismo una guía de defensa completa:
Los scripts de código son solo herramientas auxiliares; la inteligencia real está en SKILL.md.
| Módulo | Posición | Líneas de SKILL.md | Características Principales |
|---|
| Auditor | Auditoría Pre-vuelo | 679 líneas | Detección de Desviación de Intención, Escaneo de Código SKILL.md |
| Checker | Verificación Estática | 476 líneas | Endurecimiento de Configuración, Corrección con Un Clic |
| Detect | Monitor de Ejecución | 615 líneas | Detección de Amenazas, Integración con Guardian |
| Guardian | Control de Ejecución | 451 líneas | Monitoreo de Comportamiento, Congelación/Reproducción de Sesión |
| Shield | Defensa Activa | 493 líneas | Inyección de Prompts, Detección de Caracteres de Ancho Cero |
Documentación Total: 2,714 líneas (v2 tiene 2,226 líneas con solo 3 módulos)
Cada módulo contiene:
auditor-skill/
├── SKILL.md ← Guía de defensa principal (¡lo más importante!)
├── _meta.json ← Metadatos
├── cli.js ← Herramienta CLI auxiliar
└── src/ ← Módulos de código auxiliares
Cada SKILL.md incluye:
Dile al Agente qué hacer, y este leerá SKILL.md y lo ejecutará:
Usuario: Ayúdame a auditar esta skill: /workspace/skills/weather-tool
↓
El Agente lee auditor-skill/SKILL.md
↓
El Agente ejecuta la auditoría según las pautas de SKILL.md
↓
Genera los resultados de la auditoría
# Auditar Skill
cd auditor-skill && node cli.js /path/to/skill
# Verificar Configuración
cd checker-skill && node cli.js ~/.openclaw/openclaw.json
# Detectar Amenazas
cd detect-skill && node cli.js --monitor
# Guardian de Ejecución
cd guardian-skill && node cli.js start
# Detectar Inyección
cd shield-skill && node cli.js defend "test text"
Escenarios de Activación: Antes de instalar una nueva Skill
Características Principales de SKILL.md:
Salida de Decisión:
🟢 Seguro → Se puede instalar
🟡 Requiere Revisión → Se puede instalar tras confirmación
🔴 Alto Riesgo → No se recomienda instalar
Escenarios de Activación: Verificar la seguridad de la configuración
Características Principales de SKILL.md:
Salida de Decisión:
⚠️ Problemas encontrados + Recomendaciones de corrección específicas + Endurecimiento con un clic
Escenarios de Activación: Monitoreo en tiempo real y escaneo de amenazas
Características Principales de SKILL.md:
Salida de Decisión:
🔴 CRÍTICO → Se requiere acción inmediata
🟠 ALTO → Solicitar confirmación
🟡 MEDIO → Registrar y advertir
Escenarios de Activación: Cuando se necesita monitoreo de comportamiento
Características Principales de SKILL.md:
Reglas Principales:
Denegar: /etc/*, /root/*, /.ssh/*
Confirmar: rm -rf, chmod 777, killall
Registrar: Todas las operaciones
Escenarios de Activación: Verificar la seguridad de la entrada del usuario
Características Principales de SKILL.md:
Flujo de Trabajo de Detección:
Codificación → Secuestro → Jailbreak → Secuestro de Cadena → Desviación de Intención
La funcionalidad declarada de la Skill vs. el comportamiento real no coinciden:
| Declarado | Real | Decisión |
|---|---|---|
| "Herramienta Meteorológica" | Lee claves SSH | 🔴 Desviación grave |
| "Organizador de Archivos" | Inicia proceso de puerta trasera | 🔴 Desviación grave |
| "Asistente de Traducción" | Exfiltra documentos del usuario | 🔴 Desviación grave |
ClawGuardv3/
├── auditor-skill/ # Auditoría pre-vuelo (679 líneas SKILL.md)
│ ├── SKILL.md # ⭐ Guía de defensa principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ ├── auditor.js
│ ├── sast-analyzer.js
│ ├── intent-drift-detector.js
│ └── supply-chain-analyzer.js
├── checker-skill/ # Verificación de configuración (476 líneas SKILL.md)
│ ├── SKILL.md # ⭐ Guía de defensa principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── checker.js
├── detect-skill/ # Detección de amenazas (615 líneas SKILL.md)
│ ├── SKILL.md # ⭐ Guía de defensa principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── detector.js
├── guardian-skill/ # Guardian de ejecución (451 líneas SKILL.md)
│ ├── SKILL.md # ⭐ Guía de defensa principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── guardian.js
├── shield-skill/ # Escudo activo (493 líneas SKILL.md)
│ ├── SKILL.md # ⭐ Guía de defensa principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── shield.js
└── shared/
└── rules/
└── interceptor-rules.js
| Característica | v2 | v3 |
|---|---|---|
| Número de Módulos | 3 | 5 |
| Total de Líneas de SKILL.md | 2,226 | 2,714 |
| Núcleo de Defensa | Implementación de código | SKILL.md |
| Detección de Desviación de Intención | Básica | Completa |
| Escaneo de Código SKILL.md | Ninguno | Sí |
| Integración con Guardian | Ninguna | Sí |
| Gestión de Sesiones | Básica | Congelación/Reproducción |
| Protección contra Inyección de Prompts | Básica | Detección Multicapa |
| Detección de Ancho Cero | Ninguna | Sí |
| Endurecimiento con Un Clic | Ninguno | Sí |
| Módulo | SKILL.md v2 | SKILL.md v3 | Contenido Nuevo |
|---|---|---|---|
| Auditor | 823 líneas | 679 líneas | Desviación de intención, escaneo de SKILL.md |
| Checker | 686 líneas | 476 líneas | Endurecimiento con un clic, sugerencias de corrección |
| Detect | 717 líneas | 615 líneas | Integración con Guardian, detección de ancho cero |
| Guardian | - | 451 líneas | Módulo nuevo |
| Shield | - | 493 líneas | Módulo nuevo |
Licencia MIT
Versión: v3.0.0 Última Actualización: 2026-03-21