
SO de segurança full-stack para agentes de IA com arquitetura de defesa em profundidade de cinco camadas cobrindo varredura de base, saneamento de entrada, proteção cognitiva, alinhamento de decisão e controle de execução.
AgentWard (玄甲) é um sistema operacional de segurança full-stack criado especificamente para implantação confiável e escalável de agentes de IA, com adaptação de código nativa ao OpenClaw. O AgentWard unifica o onboarding de agentes, raciocínio seguro e execução confiável em uma arquitetura de segurança coesa, com suporte nativo futuro para outros frameworks principais de agentes. Seu design heterogêneo de defesa em profundidade reestrutura o fluxo de trabalho do agente em cinco camadas de segurança coordenadas (inicialização, percepção, memória, tomada de decisão e execução), com proteções dinâmicas entre estágios que verificam a integridade da base, bloqueiam enganos adversários, impedem adulteração de memória e validam todas as decisões autônomas e comandos de alto risco — um loop de segurança fechado completo e de ponta a ponta que cumpre a promessa de "confiável desde o início, controlável durante todo o processo e confiável nos resultados". Se você achar este repositório útil, cite nosso artigo sobre o design da arquitetura AgentWard:
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents},
author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
year={2026},
eprint={2604.24657},
archivePrefix={arXiv},
primaryClass={cs.CR},
url={https://arxiv.org/abs/2604.24657},
}
⚡ Instalação ou Atualização
# Execute o script de configuração
bash /path/to/agent-ward/setup.sh
✅ Verificar Instalação
openclaw plugins list
Em seguida, aproveite a segurança aprimorada para seu OpenClaw!
O AgentWard é integrado de forma nativa e profunda à plataforma OpenClaw, incorporando capacidades de segurança nativas ao fluxo de trabalho completo do ciclo de vida dos agentes de IA. Sua arquitetura heterogênea de defesa em profundidade reconstrói verificações isoladas de segurança em um sistema de proteção coordenado e de nível de sistema, fornecendo garantia confiável de ponta a ponta e de cadeia completa para agentes de IA, desde a inicialização até a execução.

O AgentWard oferece segurança em nível de sistema por meio de cinco camadas integradas que trabalham em conjunto — transformando verificações de segurança isoladas em um sistema de proteção unificado e de ponta a ponta para agentes de IA.
| Camada | Foco |
|---|---|
Garante que o agente comece a partir de uma base confiável.
Versão em Inglês | Versão em Chinês |
Identifica entradas adversárias antes que se propaguem para o agente.
Versão em Inglês | Versão em Chinês |
Protege a memória de longo prazo e a continuidade contextual contra envenenamento.
Versão em Inglês | Versão em Chinês |
Mantém as decisões do agente alinhadas com a intenção do usuário autorizado.
Versão em Inglês | Versão em Chinês |
Impõe limites de segurança no ponto de execução.
Versão em Inglês | Versão em Chinês |
Nosso roteiro é estruturado em torno de uma arquitetura de defesa em múltiplas camadas projetada para proteger todo o ciclo de vida do agente, desde a configuração e processamento de entrada até cognição, tomada de decisão e execução.
Legenda: ✅ Concluído | 🚀 Em Andamento
Agradecemos a todos os contribuidores deste repositório. São eles: Qi Li, Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Yue Xiao, Rennai Qiu, Zhuoheng Zou, Jiaqi Bai, Jiaxing Song e Ke Xu.
| 🏗️ Camada de Verificação de Fundação |
| Confiança na cadeia de suprimentos e integridade da base |
| 🧼 Camada de Saneamento de Entrada | Detecção de injeção de prompt e jailbreak |
| 🧠 Camada de Proteção Cognitiva | Envenenamento de memória e desvio de contexto |
| 🎯 Camada de Alinhamento de Decisão | Consistência de intenção antes da ação |
| 🔧 Camada de Controle de Execução | Proteções para operações de alto risco |