Toolkit de sécurité pour agents IA d'entreprise offrant un audit préalable, un durcissement de configuration, une détection des menaces en temps réel et une défense active contre l'injection de prompts et la dérive d'intention via des modules pilotés par SKILL.md.
Toolkit de sécurité pour agents IA d'entreprise - Défense active pilotée par SKILL.md
La défense principale de ClawGuard v3 ne réside pas dans le code, mais dans SKILL.md !
Le SKILL.md de chaque module est en soi un guide de défense complet :
Les scripts de code ne sont que des outils auxiliaires ; la véritable intelligence se trouve dans SKILL.md.
| Module | Position | Lignes SKILL.md | Fonctionnalités principales |
|---|
| Auditor | Audit pré-vol | 679 lignes | Détection de dérive d'intention, analyse de code SKILL.md |
| Checker | Vérification statique | 476 lignes | Durcissement de configuration, correction en un clic |
| Detect | Surveillance runtime | 615 lignes | Détection de menaces, intégration Guardian |
| Guardian | Contrôle runtime | 451 lignes | Surveillance comportementale, gel/relecture de session |
| Shield | Défense active | 493 lignes | Injection de prompt, détection de caractères de largeur nulle |
Documentation totale : 2 714 lignes (v2 compte 2 226 lignes avec seulement 3 modules)
Chaque module contient :
auditor-skill/
├── SKILL.md ← Guide de défense principal (le plus important !)
├── _meta.json ← Métadonnées
├── cli.js ← Outil CLI auxiliaire
└── src/ ← Modules de code auxiliaires
Chaque SKILL.md comprend :
Dites à l'Agent ce que vous voulez faire, et il lira SKILL.md et exécutera :
Utilisateur : Aide-moi à auditer cette compétence : /workspace/skills/weather-tool
↓
L'Agent lit auditor-skill/SKILL.md
↓
L'Agent exécute l'audit conformément aux directives de SKILL.md
↓
Sortie des résultats d'audit
# Audit de compétence
cd auditor-skill && node cli.js /path/to/skill
# Vérification de configuration
cd checker-skill && node cli.js ~/.openclaw/openclaw.json
# Détection de menaces
cd detect-skill && node cli.js --monitor
# Gardien runtime
cd guardian-skill && node cli.js start
# Détection d'injection
cd shield-skill && node cli.js defend "test text"
Scénarios de déclenchement : Avant l'installation d'une nouvelle compétence
Fonctionnalités principales de SKILL.md :
Sortie de décision :
🟢 Sûr → Peut être installé
🟡 À examiner → Peut être installé après confirmation
🔴 Risque élevé → Installation non recommandée
Scénarios de déclenchement : Vérifier la sécurité de la configuration
Fonctionnalités principales de SKILL.md :
Sortie de décision :
⚠️ Problèmes détectés + Recommandations de correction spécifiques + Durcissement en un clic
Scénarios de déclenchement : Surveillance en temps réel et analyse des menaces
Fonctionnalités principales de SKILL.md :
Sortie de décision :
🔴 CRITIQUE → Action immédiate requise
🟠 ÉLEVÉ → Demander confirmation
🟡 MOYEN → Journaliser et avertir
Scénarios de déclenchement : Lorsqu'une surveillance comportementale est nécessaire
Fonctionnalités principales de SKILL.md :
Règles principales :
Refuser : /etc/*, /root/*, /.ssh/*
Confirmer : rm -rf, chmod 777, killall
Journaliser : Toutes les opérations
Scénarios de déclenchement : Vérifier la sécurité des entrées utilisateur
Fonctionnalités principales de SKILL.md :
Flux de travail de détection :
Encodage → Détournement → Jailbreak → Détournement de chaîne → Dérive d'intention
La fonctionnalité déclarée de la compétence ne correspond pas à son comportement réel :
| Déclaré | Réel | Décision |
|---|---|---|
| « Outil météo » | Lit les clés SSH | 🔴 Dérive grave |
| « Organisateur de fichiers » | Démarre un processus de porte dérobée | 🔴 Dérive grave |
| « Assistant de traduction » | Exfiltre les documents utilisateur | 🔴 Dérive grave |
ClawGuardv3/
├── auditor-skill/ # Audit pré-vol (679 lignes SKILL.md)
│ ├── SKILL.md # ⭐ Guide de défense principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ ├── auditor.js
│ ├── sast-analyzer.js
│ ├── intent-drift-detector.js
│ └── supply-chain-analyzer.js
├── checker-skill/ # Vérification de configuration (476 lignes SKILL.md)
│ ├── SKILL.md # ⭐ Guide de défense principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── checker.js
├── detect-skill/ # Détection de menaces (615 lignes SKILL.md)
│ ├── SKILL.md # ⭐ Guide de défense principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── detector.js
├── guardian-skill/ # Gardien runtime (451 lignes SKILL.md)
│ ├── SKILL.md # ⭐ Guide de défense principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── guardian.js
├── shield-skill/ # Bouclier actif (493 lignes SKILL.md)
│ ├── SKILL.md # ⭐ Guide de défense principal
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── shield.js
└── shared/
└── rules/
└── interceptor-rules.js
| Fonctionnalité | v2 | v3 |
|---|---|---|
| Nombre de modules | 3 | 5 |
| Total de lignes SKILL.md | 2 226 | 2 714 |
| Noyau de défense | Implémentation de code | SKILL.md |
| Détection de dérive d'intention | Basique | Complète |
| Analyse de code SKILL.md | Aucune | Oui |
| Intégration Guardian | Aucune | Oui |
| Gestion de session | Basique | Gel/Relecture |
| Protection contre l'injection de prompt | Basique | Détection multicouche |
| Détection de largeur nulle | Aucune | Oui |
| Durcissement en un clic | Aucun | Oui |
| Module | v2 SKILL.md | v3 SKILL.md | Nouveau contenu |
|---|---|---|---|
| Auditor | 823 lignes | 679 lignes | Dérive d'intention, analyse SKILL.md |
| Checker | 686 lignes | 476 lignes | Durcissement en un clic, suggestions de correction |
| Detect | 717 lignes | 615 lignes | Intégration Guardian, détection de largeur nulle |
| Guardian | - | 451 lignes | Nouveau module |
| Shield | - | 493 lignes | Nouveau module |
Licence MIT
Version : v3.0.0 Dernière mise à jour : 2026-03-21