
Toolkit di sicurezza per agenti AI aziendali che fornisce audit pre-avvio, hardening della configurazione, rilevamento delle minacce in runtime e difesa attiva contro l'iniezione di prompt e la deriva delle intenzioni tramite moduli basati su SKILL.md.
Toolkit di Sicurezza Enterprise per Agenti AI - Difesa Attiva Guidata da SKILL.md
La difesa principale di ClawGuard v3 non sta nel codice, ma in SKILL.md!
Il SKILL.md di ogni modulo è di per sé una guida di difesa completa:
Gli script di codice sono solo strumenti ausiliari; la vera intelligenza sta in SKILL.md.
| Modulo | Posizione | Righe SKILL.md | Funzionalità Principali |
|---|
| Auditor | Audit Pre-volo | 679 righe | Rilevamento Deriva di Intent, Scansione Codice SKILL.md |
| Checker | Controllo Statico | 476 righe | Hardening della Configurazione, Correzione con un Click |
| Detect | Monitoraggio Runtime | 615 righe | Rilevamento Minacce, Integrazione Guardian |
| Guardian | Controllo Runtime | 451 righe | Monitoraggio Comportamentale, Congelamento/Riproduzione Sessione |
| Shield | Difesa Attiva | 493 righe | Prompt Injection, Rilevamento Caratteri Zero-Width |
Documentazione Totale: 2.714 righe (v2 ha 2.226 righe con solo 3 moduli)
Ogni modulo contiene:
auditor-skill/
├── SKILL.md ← Guida di difesa principale (la più importante!)
├── _meta.json ← Metadati
├── cli.js ← Strumento CLI ausiliario
└── src/ ← Moduli di codice ausiliari
Ogni SKILL.md include:
Dì all'Agente cosa fare, e leggerà SKILL.md ed eseguirà:
Utente: Aiutami ad auditare questa skill: /workspace/skills/weather-tool
↓
L'Agente legge auditor-skill/SKILL.md
↓
L'Agente esegue l'audit secondo le linee guida di SKILL.md
↓
Output dei risultati dell'audit
# Audit Skill
cd auditor-skill && node cli.js /path/to/skill
# Controllo Configurazione
cd checker-skill && node cli.js ~/.openclaw/openclaw.json
# Rilevamento Minacce
cd detect-skill && node cli.js --monitor
# Guardian Runtime
cd guardian-skill && node cli.js start
# Rilevamento Injection
cd shield-skill && node cli.js defend "test text"
Scenari di Attivazione: Prima di installare una nuova Skill
Funzionalità Principali di SKILL.md:
Output Decisionale:
🟢 Sicuro → Può essere installato
🟡 Richiede Revisione → Può essere installato dopo conferma
🔴 Rischio Elevato → Installazione non consigliata
Scenari di Attivazione: Controllo della sicurezza della configurazione
Funzionalità Principali di SKILL.md:
Output Decisionale:
⚠️ Problemi trovati + Raccomandazioni di correzione specifiche + Hardening con un click
Scenari di Attivazione: Monitoraggio in tempo reale e scansione delle minacce
Funzionalità Principali di SKILL.md:
Output Decisionale:
🔴 CRITICO → Azione immediata richiesta
🟠 ALTO → Richiedi conferma
🟡 MEDIO → Registra e avvisa
Scenari di Attivazione: Quando è necessario il monitoraggio comportamentale
Funzionalità Principali di SKILL.md:
Regole Principali:
Nega: /etc/*, /root/*, /.ssh/*
Conferma: rm -rf, chmod 777, killall
Registra: Tutte le operazioni
Scenari di Attivazione: Controllo della sicurezza degli input utente
Funzionalità Principali di SKILL.md:
Flusso di Lavoro di Rilevamento:
Codifica → Hijacking → Jailbreak → Hijacking Catena → Deriva di Intent
La funzionalità dichiarata della Skill vs. il comportamento effettivo non corrisponde:
| Dichiarato | Effettivo | Decisione |
|---|---|---|
| "Strumento Meteo" | Legge chiavi SSH | 🔴 Deriva grave |
| "Organizzatore File" | Avvia processo backdoor | 🔴 Deriva grave |
| "Assistente Traduzione" | Esfiltra documenti utente | 🔴 Deriva grave |
ClawGuardv3/
├── auditor-skill/ # Audit pre-volo (679 righe SKILL.md)
│ ├── SKILL.md # ⭐ Guida di difesa principale
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ ├── auditor.js
│ ├── sast-analyzer.js
│ ├── intent-drift-detector.js
│ └── supply-chain-analyzer.js
├── checker-skill/ # Controllo configurazione (476 righe SKILL.md)
│ ├── SKILL.md # ⭐ Guida di difesa principale
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── checker.js
├── detect-skill/ # Rilevamento minacce (615 righe SKILL.md)
│ ├── SKILL.md # ⭐ Guida di difesa principale
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── detector.js
├── guardian-skill/ # Guardian runtime (451 righe SKILL.md)
│ ├── SKILL.md # ⭐ Guida di difesa principale
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── guardian.js
├── shield-skill/ # Scudo attivo (493 righe SKILL.md)
│ ├── SKILL.md # ⭐ Guida di difesa principale
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── shield.js
└── shared/
└── rules/
└── interceptor-rules.js
| Funzionalità | v2 | v3 |
|---|---|---|
| Numero di Moduli | 3 | 5 |
| Totale Righe SKILL.md | 2.226 | 2.714 |
| Nucleo di Difesa | Implementazione codice | SKILL.md |
| Rilevamento Deriva di Intent | Base | Completo |
| Scansione Codice SKILL.md | Nessuna | Sì |
| Integrazione Guardian | Nessuna | Sì |
| Gestione Sessioni | Base | Congelamento/Riproduzione |
| Protezione Prompt Injection | Base | Rilevamento Multi-livello |
| Rilevamento Zero-Width | Nessuno | Sì |
| Hardening con un Click | Nessuno | Sì |
| Modulo | v2 SKILL.md | v3 SKILL.md | Nuovo Contenuto |
|---|---|---|---|
| Auditor | 823 righe | 679 righe | Deriva di intent, scansione SKILL.md |
| Checker | 686 righe | 476 righe | Hardening con un click, suggerimenti di correzione |
| Detect | 717 righe | 615 righe | Integrazione Guardian, rilevamento zero-width |
| Guardian | - | 451 righe | Nuovo modulo |
| Shield | - | 493 righe | Nuovo modulo |
Licenza MIT
Versione: v3.0.0 Ultimo Aggiornamento: 2026-03-21