
Full-Stack-Sicherheits-Betriebssystem für KI-Agenten mit einer fünfschichtigen Verteidigungs-in-der-Tiefe-Architektur, die Fundament-Scan, Eingabebereinigung, Kognitionsschutz, Entscheidungsausrichtung und Ausführungskontrolle umfasst.
AgentWard (玄甲) ist ein ganzheitliches Sicherheitsbetriebssystem, das speziell für vertrauenswürdige, skalierbare KI-Agenten-Bereitstellung entwickelt wurde, mit nativer Code-Anpassung an OpenClaw. AgentWard vereint Agenten-Onboarding, sicheres Reasoning und vertrauenswürdige Ausführung in einer einheitlichen Sicherheitsarchitektur, mit bevorstehender nativer Unterstützung für andere führende Mainstream-Agenten-Frameworks. Die heterogene Defense-in-Depth-Architektur ordnet den Agenten-Workflow in fünf koordinierte Sicherheitsebenen neu – über Start, Wahrnehmung, Gedächtnis, Entscheidungsfindung und Ausführung – mit dynamischen, stufenübergreifenden Schutzmaßnahmen, die die Integrität der Grundlage verifizieren, feindliche Täuschung blockieren, Speichermanipulation stoppen und jede autonome Entscheidung sowie risikoreiche Befehle validieren. Eine vollständige, durchgängige, geschlossene Sicherheitsschleife, die das Versprechen „vertrauenswürdig von Anfang an, kontrollierbar während des gesamten Prozesses und zuverlässig in den Ergebnissen“ einlöst. Wenn Sie dieses Repository nützlich finden, zitieren Sie bitte unser Paper zum Design der AgentWard-Architektur:
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents},
author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
year={2026},
eprint={2604.24657},
archivePrefix={arXiv},
primaryClass={cs.CR},
url={https://arxiv.org/abs/2604.24657},
}
⚡ Installation oder Update
# Setupskript ausführen
bash /path/to/agent-ward/setup.sh
✅ Installation überprüfen
openclaw plugins list
Genießen Sie dann die erhöhte Sicherheit für Ihr OpenClaw!
AgentWard ist nativ und tief in die OpenClaw-Plattform integriert und bettet native Sicherheitsfähigkeiten in den gesamten Lebenszyklus-Workflow von KI-Agenten ein. Die heterogene Defense-in-Depth-Architektur rekonstruiert isolierte Einzelpunkt-Sicherheitsprüfungen in ein geschlossenes, koordiniertes Systemschutzsystem und bietet eine durchgängige, vollständige Vertrauenswürdigkeitssicherung für KI-Agenten vom Start bis zur Ausführung.

AgentWard bietet Sicherheit auf Systemebene durch fünf eng integrierte Ebenen, die zusammenarbeiten – isolierte Sicherheitsprüfungen werden in ein einheitliches, durchgängiges Schutzsystem für KI-Agenten umgewandelt.
| Ebene | Fokus |
|---|---|
| 🏗️ Grundlagenscan-Ebene | Vertrauenskette und Basisintegrität |
| 🧼 Eingabebereinigungsebene | Prompt-Injection- und Jailbreak-Erkennung |
| 🧠 Kognitionsschutzebene | Gedächtnisvergiftung und Kontextdrift |
| 🎯 Entscheidungsabgleichsebene | Absichtsübereinstimmung vor der Aktion |
| 🔧 Ausführungskontrollebene | Sicherheitsleitplanken für risikoreiche Operationen |
Stellt sicher, dass der Agent von einer vertrauenswürdigen Grundlage startet.
Englische Version |
Chinesische Version |
Erkennt feindliche Eingaben, bevor sie in den Agenten gelangen.
Englische Version |
Chinesische Version |
Schützt das Langzeitgedächtnis und die kontextuelle Kontinuität vor Vergiftung.