
Enterprise-KI-Agenten-Sicherheits-Toolkit, das Pre-Flight-Auditing, Konfigurationshärtung, Laufzeit-Bedrohungserkennung und aktive Verteidigung gegen Prompt-Injection und Intent-Drift über SKILL.md-gesteuerte Module bietet.
Enterprise AI Agent Security Toolkit – SKILL.md-gesteuerte aktive Verteidigung
Die Kernverteidigung von ClawGuard v3 liegt nicht im Code, sondern in SKILL.md!
Die SKILL.md jedes Moduls ist selbst ein vollständiger Verteidigungsleitfaden:
Codeskripte sind nur Hilfswerkzeuge; die eigentliche Intelligenz steckt in SKILL.md.
| Modul | Position | SKILL.md-Zeilen | Kernfunktionen |
|---|
| Auditor | Pre-Flight-Audit | 679 Zeilen | Intent-Drift-Erkennung, SKILL.md-Codescan |
| Checker | Statischer Check | 476 Zeilen | Konfigurations-Härtung, Ein-Klick-Fix |
| Detect | Laufzeitmonitor | 615 Zeilen | Bedrohungserkennung, Guardian-Integration |
| Guardian | Laufzeitkontrolle | 451 Zeilen | Verhaltensüberwachung, Sitzungs-Freeze/Replay |
| Shield | Aktive Verteidigung | 493 Zeilen | Prompt-Injection, Zero-Width-Erkennung |
Gesamtdokumentation: 2.714 Zeilen (v2 hat 2.226 Zeilen mit nur 3 Modulen)
Jedes Modul enthält:
auditor-skill/
├── SKILL.md ← Kernverteidigungsleitfaden (am wichtigsten!)
├── _meta.json ← Metadaten
├── cli.js ← Hilfs-CLI-Tool
└── src/ ← Hilfs-Codemodule
Jede SKILL.md enthält:
Sagen Sie dem Agenten, was er tun soll, und er liest SKILL.md und führt es aus:
User: Hilf mir, dieses Skill zu auditieren: /workspace/skills/weather-tool
↓
Agent liest auditor-skill/SKILL.md
↓
Agent führt das Audit gemäß den SKILL.md-Richtlinien aus
↓
Gibt Audit-Ergebnisse aus
# Skill auditieren
cd auditor-skill && node cli.js /path/to/skill
# Konfiguration prüfen
cd checker-skill && node cli.js ~/.openclaw/openclaw.json
# Bedrohungen erkennen
cd detect-skill && node cli.js --monitor
# Laufzeit-Guardian
cd guardian-skill && node cli.js start
# Injection erkennen
cd shield-skill && node cli.js defend "test text"
Auslöseszenarien: Vor der Installation eines neuen Skills
Kernfunktionen von SKILL.md:
Entscheidungsausgabe:
🟢 Sicher → Kann installiert werden
🟡 Überprüfung nötig → Kann nach Bestätigung installiert werden
🔴 Hohes Risiko → Installation nicht empfohlen
Auslöseszenarien: Sicherheit der Konfiguration prüfen
Kernfunktionen von SKILL.md:
Entscheidungsausgabe:
⚠️ Probleme gefunden + Spezifische Fix-Empfehlungen + Ein-Klick-Härtung
Auslöseszenarien: Echtzeitüberwachung und Bedrohungsscan
Kernfunktionen von SKILL.md:
Entscheidungsausgabe:
🔴 KRITISCH → Sofortiges Handeln erforderlich
🟠 HOCH → Bestätigung anfordern
🟡 MITTEL → Protokollieren und warnen
Auslöseszenarien: Wenn Verhaltensüberwachung benötigt wird
Kernfunktionen von SKILL.md:
Kernregeln:
Deny: /etc/*, /root/*, /.ssh/*
Confirm: rm -rf, chmod 777, killall
Log: Alle Operationen
Auslöseszenarien: Sicherheit von Benutzereingaben prüfen
Kernfunktionen von SKILL.md:
Erkennungsablauf:
Kodierung → Hijacking → Jailbreak → Ketten-Hijacking → Intent-Drift
Die behauptete Funktionalität des Skills stimmt nicht mit dem tatsächlichen Verhalten überein:
| Behauptet | Tatsächlich | Entscheidung |
|---|---|---|
| „Wetter-Tool" | Liest SSH-Schlüssel | 🔴 Schwere Abweichung |
| „Dateiorganisator" | Startet Backdoor-Prozess | 🔴 Schwere Abweichung |
| „Übersetzungsassistent" | Exfiltriert Benutzerdokumente | 🔴 Schwere Abweichung |
ClawGuardv3/
├── auditor-skill/ # Pre-Flight-Audit (679 Zeilen SKILL.md)
│ ├── SKILL.md # ⭐ Kernverteidigungsleitfaden
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ ├── auditor.js
│ ├── sast-analyzer.js
│ ├── intent-drift-detector.js
│ └── supply-chain-analyzer.js
├── checker-skill/ # Konfigurationsprüfung (476 Zeilen SKILL.md)
│ ├── SKILL.md # ⭐ Kernverteidigungsleitfaden
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── checker.js
├── detect-skill/ # Bedrohungserkennung (615 Zeilen SKILL.md)
│ ├── SKILL.md # ⭐ Kernverteidigungsleitfaden
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── detector.js
├── guardian-skill/ # Laufzeit-Guardian (451 Zeilen SKILL.md)
│ ├── SKILL.md # ⭐ Kernverteidigungsleitfaden
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── guardian.js
├── shield-skill/ # Aktiver Schild (493 Zeilen SKILL.md)
│ ├── SKILL.md # ⭐ Kernverteidigungsleitfaden
│ ├── _meta.json
│ ├── cli.js
│ └── src/
│ └── shield.js
└── shared/
└── rules/
└── interceptor-rules.js
| Funktion | v2 | v3 |
|---|---|---|
| Anzahl der Module | 3 | 5 |
| Gesamte SKILL.md-Zeilen | 2.226 | 2.714 |
| Verteidigungskern | Code-Implementierung | SKILL.md |
| Intent-Drift-Erkennung | Grundlegend | Vollständig |
| SKILL.md-Codescan | Keiner | Ja |
| Guardian-Integration | Keine | Ja |
| Sitzungsverwaltung | Grundlegend | Freeze/Replay |
| Prompt-Injection-Schutz | Grundlegend | Mehrschichtige Erkennung |
| Zero-Width-Erkennung | Keine | Ja |
| Ein-Klick-Härtung | Keine | Ja |
| Modul | v2 SKILL.md | v3 SKILL.md | Neue Inhalte |
|---|---|---|---|
| Auditor | 823 Zeilen | 679 Zeilen | Intent-Drift, SKILL.md-Scan |
| Checker | 686 Zeilen | 476 Zeilen | Ein-Klick-Härtung, Fix-Vorschläge |
| Detect | 717 Zeilen | 615 Zeilen | Guardian-Integration, Zero-Width-Erkennung |
| Guardian | - | 451 Zeilen | Neues Modul |
| Shield | - | 493 Zeilen | Neues Modul |
MIT-Lizenz
Version: v3.0.0 Zuletzt aktualisiert: 2026-03-21