AgentWard (玄甲) 是一个专为可信、可扩展的 AI 智能体部署而构建的全栈安全操作系统,原生适配 OpenClaw。AgentWard 将智能体接入、安全推理与可信执行统一在一个紧凑的安全架构中,并即将原生支持其他主流智能体框架。其异构纵深防御设计将智能体工作流重构为启动、感知、记忆、决策和执行五个协同的安全层,通过动态跨阶段防护机制,验证基础完整性、阻止对抗欺骗、防止内存篡改,并验证每个自主决策和高风险指令——形成一个完整、端到端的闭环安全体系,实现“初始可信、过程可控、结果可靠”的安全承诺。如果您觉得这个仓库有用,请引用我们关于 AgentWard 架构设计的论文:
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents},
author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
year={2026},
eprint={2604.24657},
archivePrefix={arXiv},
primaryClass={cs.CR},
url={https://arxiv.org/abs/2604.24657},
}
⚡ 安装或更新
# 运行安装脚本
bash /path/to/agent-ward/setup.sh
✅ 验证安装
openclaw plugins list
然后即可为您的 OpenClaw 享受增强安全保护!
AgentWard 与 OpenClaw 平台原生深度集成,将原生安全能力嵌入 AI 智能体的全生命周期工作流。其异构纵深防御架构将孤立的单点安全检查重构为闭环、协同的系统级防护体系,为 AI 智能体从启动到执行提供端到端、全链路的可信保障。

AgentWard 通过五个紧密集成的层提供系统级安全,它们协同工作——将孤立的安全检查转变为统一的、端到端的 AI 智能体保护系统。
| 层 | 关注点 |
|---|---|
| 🏗️ 基础扫描层 | 供应链信任与基线完整性 |
| 🧼 输入净化层 | 提示注入与越狱检测 |
| 🧠 认知保护层 | 内存投毒与上下文漂移 |
| 🎯 决策对齐层 | 行动前的意图一致性 |
| 🔧 执行控制层 |
确保智能体从可信的基础启动。
英文版 | 中文版 |
在对抗性输入传播到智能体之前将其识别出来。
英文版 | 中文版 |
保护长期记忆和上下文连续性免受投毒。
英文版 | 中文版 |
让智能体决策与授权用户意图保持一致。
英文版 | 中文版 |
在执行点强制执行安全边界。
英文版 | 中文版 |
我们的路线图围绕多层防御架构展开,旨在保护智能体的整个生命周期(从配置、输入处理到认知、决策和执行)。
图例:✅ 已完成 | 🚀 进行中
我们感谢本仓库的所有贡献者。他们是 Qi Li、Xinhao Deng、Yixiang Zhang、Jiaqing Wu、Yue Xiao、Rennai Qiu、Zhuoheng Zou、Jiaqi Bai、Jiaxing Song 和 Ke Xu。
| 高风险操作护栏 |