
Enterprise AI agent security toolkit que fornece auditoria pré-execução, endurecimento de configuração, detecção de ameaças em tempo de execução e defesa ativa contra injeção de prompt e desvio de intenção por meio de módulos orientados por SKILL.md.
Kit de Segurança para Agentes de IA Empresariais - Defesa Ativa Orientada por SKILL.md
A defesa central do ClawGuard v3 não está no código, mas no SKILL.md!
O SKILL.md de cada módulo é, por si só, um guia de defesa completo:
Os scripts de código são apenas ferramentas auxiliares; a inteligência real está no SKILL.md.
| Módulo | Posição | Linhas do SKILL.md | Recursos Principais |
|---|
| Auditor | Auditoria Pré-voo | 679 linhas | Detecção de Desvio de Intenção, Varredura de Código SKILL.md |
| Checker | Verificação Estática | 476 linhas | Endurecimento de Configuração, Correção com Um Clique |
| Detect | Monitor de Execução | 615 linhas | Detecção de Ameaças, Integração com Guardian |
| Guardian | Controle de Execução | 451 linhas | Monitoramento de Comportamento, Congelamento/Reprodução de Sessão |
| Shield | Defesa Ativa | 493 linhas | Injeção de Prompt, Detecção de Largura Zero |
Documentação Total: 2.714 linhas (v2 tem 2.226 linhas com apenas 3 módulos)
Cada módulo contém:
auditor-skill/
├── SKILL.md ← Guia de defesa central (mais importante!)
├── _meta.json ← Metadados
├── cli.js ← Ferramenta CLI auxiliar
└── src/ ← Módulos de código auxiliares
Cada SKILL.md inclui:
Diga ao Agente o que fazer, e ele lerá o SKILL.md e executará:
Usuário: Ajude-me a auditar esta skill: /workspace/skills/weather-tool
↓
O Agente lê auditor-skill/SKILL.md
↓
O Agente executa a auditoria de acordo com as diretrizes do SKILL.md
↓
Gera os resultados da auditoria
# Auditar Skill
cd auditor-skill && node cli.js /path/to/skill
# Verificar Configuração
cd checker-skill && node cli.js ~/.openclaw/openclaw.json
# Detectar Ameaças
cd detect-skill && node cli.js --monitor
# Guardian de Execução
cd guardian-skill && node cli.js start
# Detectar Injeção
cd shield-skill && node cli.js defend "test text"
Cenários de Acionamento: Antes de instalar uma nova Skill
Recursos Principais do SKILL.md:
Saída de Decisão:
🟢 Seguro → Pode instalar
🟡 Requer Revisão → Pode instalar após confirmação
🔴 Alto Risco → Não recomendado instalar
Cenários de Acionamento: Verificar a segurança da configuração
Recursos Principais do SKILL.md:
Saída de Decisão:
⚠️ Problemas encontrados + Recomendações de correção específicas + Endurecimento com um clique
Cenários de Acionamento: Monitoramento em tempo real e varredura de ameaças
Recursos Principais do SKILL.md:
Saída de Decisão:
🔴 CRÍTICO → Ação imediata necessária
🟠 ALTO → Solicitar confirmação
🟡 MÉDIO → Registrar e alertar
Cenários de Acionamento: Quando o monitoramento de comportamento é necessário
Recursos Principais do SKILL.md:
Regras Principais:
Negar: /etc/*, /root/*, /.ssh/*
Confirmar: rm -rf, chmod 777, killall
Registrar: Todas as operações
Cenários de Acionamento: Verificar a segurança da entrada do usuário
Recursos Principais do SKILL.md:
Fluxo de Trabalho de Detecção:
Codificação → Sequestro → Jailbreak → Sequestro de Cadeia → Desvio de Intenção
A funcionalidade declarada da Skill vs. o comportamento real não correspondem:
| Declarado | Real | Decisão |
|---|---|---|
| "Ferramenta de Clima" | Lê chaves SSH | 🔴 Desvio grave |
| "Organizador de Arquivos" | Inicia processo de backdoor | 🔴 Desvio grave |
| "Assistente de Tradução" | Exfiltra documentos do usuário | 🔴 Desvio grave |
ClawGuardv3/
├── auditor-skill/ # Auditoria pré-voo (679 linhas SKILL.md)
│ ├── SKILL.md # ⭐ Guia de defesa central
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ ├── auditor.js
│ ├── sast-analyzer.js
│ ├── intent-drift-detector.js
│ └── supply-chain-analyzer.js
├── checker-skill/ # Verificação de configuração (476 linhas SKILL.md)
│ ├── SKILL.md # ⭐ Guia de defesa central
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── checker.js
├── detect-skill/ # Detecção de ameaças (615 linhas SKILL.md)
│ ├── SKILL.md # ⭐ Guia de defesa central
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── detector.js
├── guardian-skill/ # Guardião de execução (451 linhas SKILL.md)
│ ├── SKILL.md # ⭐ Guia de defesa central
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── guardian.js
├── shield-skill/ # Escudo ativo (493 linhas SKILL.md)
│ ├── SKILL.md # ⭐ Guia de defesa central
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── shield.js
└── shared/
└── rules/
└── interceptor-rules.js
| Recurso | v2 | v3 |
|---|---|---|
| Número de Módulos | 3 | 5 |
| Total de Linhas SKILL.md | 2.226 | 2.714 |
| Núcleo de Defesa | Implementação em código | SKILL.md |
| Detecção de Desvio de Intenção | Básica | Completa |
| Varredura de Código SKILL.md | Nenhuma | Sim |
| Integração com Guardian | Nenhuma | Sim |
| Gerenciamento de Sessão | Básico | Congelamento/Reprodução |
| Proteção contra Injeção de Prompt | Básica | Detecção em Múltiplas Camadas |
| Detecção de Largura Zero | Nenhuma | Sim |
| Endurecimento com Um Clique | Nenhum | Sim |
| Módulo | SKILL.md v2 | SKILL.md v3 | Novo Conteúdo |
|---|---|---|---|
| Auditor | 823 linhas | 679 linhas | Desvio de intenção, varredura SKILL.md |
| Checker | 686 linhas | 476 linhas | Endurecimento com um clique, sugestões de correção |
| Detect | 717 linhas | 615 linhas | Integração com Guardian, detecção de largura zero |
| Guardian | - | 451 linhas | Novo módulo |
| Shield | - | 493 linhas | Novo módulo |
Licença MIT
Versão: v3.0.0 Última Atualização: 2026-03-21