Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
AgentWard — SO de segurança full-stack para agentes de IA com arquitetura de defesa em profundidade de cinco camadas cobrindo varredura de base, saneamento de entrada, proteção cognitiva, alinhamento de decisão e controle de execução. | Kitploit
Ferramentas/GitHubGitHub/find-lab/agentward
Ferramentas DefensivasInteligência de AmeaçasSegurança da Cadeia de SuprimentosPapers e PesquisaConfiguração IncorretaAprendizado e EducaçãoSegurança de IADetecção de Anomalias
GitHubfind-lab/agentward

AgentWard

SO de segurança full-stack para agentes de IA com arquitetura de defesa em profundidade de cinco camadas cobrindo varredura de base, saneamento de entrada, proteção cognitiva, alinhamento de decisão e controle de execução.

639há 2 mesesRevisado pelo Kitploit

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar
Ver Repositório

AgentWard · 玄甲OS

AgentWard (玄甲) é um sistema operacional de segurança full-stack criado especificamente para implantação confiável e escalável de agentes de IA, com adaptação de código nativa ao OpenClaw. O AgentWard unifica o onboarding de agentes, raciocínio seguro e execução confiável em uma arquitetura de segurança coesa, com suporte nativo futuro para outros frameworks principais de agentes. Seu design heterogêneo de defesa em profundidade reestrutura o fluxo de trabalho do agente em cinco camadas de segurança coordenadas (inicialização, percepção, memória, tomada de decisão e execução), com proteções dinâmicas entre estágios que verificam a integridade da base, bloqueiam enganos adversários, impedem adulteração de memória e validam todas as decisões autônomas e comandos de alto risco — um loop de segurança fechado completo e de ponta a ponta que cumpre a promessa de "confiável desde o início, controlável durante todo o processo e confiável nos resultados". Se você achar este repositório útil, cite nosso artigo sobre o design da arquitetura AgentWard:

root@kitploit:~
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
      title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents}, 
      author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
      year={2026},
      eprint={2604.24657},
      archivePrefix={arXiv},
      primaryClass={cs.CR},
      url={https://arxiv.org/abs/2604.24657}, 
}

Por que AgentWard

  • 🛡️ Cobertura Abrangente de Riscos — Arquitetura heterogênea de Defesa em Profundidade (DiD) oferece garantia de segurança completa para agentes, bloqueando diversos vetores de ataque em toda a superfície de ataque do agente.
  • ⚡ Implantação com um Clique — Design nativo de plugin insere segurança nativamente em todo o ciclo de vida do agente. Habilite segurança abrangente para agentes com um clique por meio de integração não intrusiva, garantindo adaptação de versão perfeita e rápida para o OpenClaw.
  • 🔒 Controles Determinísticos em Nível de Sistema — Fornece controles determinísticos, totalmente auditáveis e aplicados por código, que superam soluções baseadas em habilidades que dependem de segurança endógena, com suporte nativo para implantação em larga escala e prontidão para produção.
  • 🌐 Padrão de Segurança Aberto e Extensível — Padrão aberto, transparente, auditável e orientado pela comunidade, com arquitetura modular projetada para extensibilidade. Construído com desacoplamento completo framework-algoritmo para integração facilitada de algoritmos de detecção avançados, com roteiro para estender o suporte a sistemas agentivos gerais.

Início Rápido

  1. ⚡ Instalação ou Atualização

    root@kitploit:~
    # Execute o script de configuração
    bash /path/to/agent-ward/setup.sh
    
  2. ✅ Verificar Instalação

    root@kitploit:~
    openclaw plugins list
    

    Em seguida, aproveite a segurança aprimorada para seu OpenClaw!

Arquitetura Sistemática

O AgentWard é integrado de forma nativa e profunda à plataforma OpenClaw, incorporando capacidades de segurança nativas ao fluxo de trabalho completo do ciclo de vida dos agentes de IA. Sua arquitetura heterogênea de defesa em profundidade reconstrói verificações isoladas de segurança em um sistema de proteção coordenado e de nível de sistema, fornecendo garantia confiável de ponta a ponta e de cadeia completa para agentes de IA, desde a inicialização até a execução.

AgentWard Blueprint

Cinco Camadas de Defesa Coordenadas

O AgentWard oferece segurança em nível de sistema por meio de cinco camadas integradas que trabalham em conjunto — transformando verificações de segurança isoladas em um sistema de proteção unificado e de ponta a ponta para agentes de IA.

CamadaFoco

🚨 Resposta e Mitigação de Ameaças

  • 📢 Enviar mensagens de alerta via IM quando ameaças forem detectadas
  • 🛑 Bloquear automaticamente operações perigosas sem intervenção humana
  • 📝 Descrições de alerta claras para ajudar a entender os riscos

⚙️ Configuração Flexível

  • 🎚️ Cada camada de proteção pode ser ativada/desativada independentemente
  • 👁️ Suporta modo "apenas detecção" para reduzir o impacto de falsos positivos
  • 📋 Algumas camadas suportam regras personalizadas para atender a requisitos específicos de cenário

Visualização da Defesa

🏗️ Camada 1: Verificação de Fundação

Garante que o agente comece a partir de uma base confiável.

Versão em Inglês

Versão em Chinês

🧼 Camada 2: Saneamento de Entrada

Identifica entradas adversárias antes que se propaguem para o agente.

Versão em Inglês

Versão em Chinês

🧠 Camada 3: Proteção Cognitiva

Protege a memória de longo prazo e a continuidade contextual contra envenenamento.

Versão em Inglês

Versão em Chinês

🎯 Camada 4: Alinhamento de Decisão

Mantém as decisões do agente alinhadas com a intenção do usuário autorizado.

Versão em Inglês

Versão em Chinês

🔧 Camada 5: Controle de Execução

Impõe limites de segurança no ponto de execução.

Versão em Inglês

Versão em Chinês

Roteiro

🏆 Sistema de Segurança Full-Stack de Ponta a Ponta

Nosso roteiro é estruturado em torno de uma arquitetura de defesa em múltiplas camadas projetada para proteger todo o ciclo de vida do agente, desde a configuração e processamento de entrada até cognição, tomada de decisão e execução.

📐 Framework de Infraestrutura do Sistema

  • ✅ Arquitetura modular nativa de plugin
  • ✅ Conjunto de adaptadores base
  • ✅ Mecanismo de detecção principal
    • ✅ Módulo de detecção baseado em regras heurísticas
    • ✅ Sistema de avaliação de risco de intenção
    • 🚀 Capacidades de avaliação de risco consciente de confiança
  • 🚀 Suporte a SOs heterogêneos
    • ✅ Linux
    • 🚀 macOS
    • 🚀 Windows

🏗️ Camada de Verificação de Fundação

  • ✅ Verificações de segurança de configuração global e em nível de plugin
  • ✅ Detecção semântica de habilidades maliciosas
  • 🚀 Verificação de fonte de habilidades
  • 🚀 Análise de dependência de plugins
  • 🚀 Detecção híbrida de vulnerabilidades em linguagem natural e código

🧼 Camada de Saneamento de Entrada

  • ✅ Detecção baseada em regras de injeção e jailbreak
  • ✅ Análise de coerência semântica para entradas do usuário
  • ✅ Detecção de instruções maliciosas fragmentadas
  • 🚀 Detecção de ataques furtivos de múltiplas rodadas
  • 🚀 Reescrevendo e substituindo conteúdo malicioso de forma segura
  • 🚀 Detecção de ataque de injeção multimodal

🧠 Camada de Proteção Cognitiva

  • ✅ Avaliação e calibragem de consistência de memória
  • 🚀 Construção de corpus de memória maliciosa e correspondência de ameaças
  • 🚀 Vetorização de memória e detecção de anomalias
  • 🚀 Recuperação de memória baseada em checkpoint
  • 🚀 Detecção e correção de desvio de contexto

🎯 Camada de Alinhamento de Decisão

  • ✅ Validação de consistência entre decisões do agente e intenção do usuário
  • 🚀 Filtragem de regras estáticas e verificação de conformidade
  • 🚀 Auditoria de raciocínio de trajetória de múltiplas etapas
  • 🚀 Alocação de permissão dinâmica adaptativa a risco
  • 🚀 Identificação de ações de alto risco e reescrita segura

🔧 Camada de Controle de Execução

  • ✅ Interceptação e bloqueio em tempo real de instruções de sistema de alto risco
  • ✅ Análise de intenção comportamental e avaliação de risco
  • 🚀 Controle de permissão dinâmico com reconhecimento de identidade e restrição de acesso
  • 🚀 Validação de segurança pré-execução para ações do agente
  • 🚀 Reversão e recuperação automática para estados de execução anormais
  • 🚀 Observabilidade em nível de sistema com eBPF
    • 🚀 Monitoramento de recursos em tempo real e restrição adaptativa
    • 🚀 Auditoria de payload de rede e detecção de anomalias

🤝 Colaboração entre Camadas

  • ✅ Agregação global de informações e descoberta de riscos
  • 🚀 Perfil de confiança baseado em comportamento histórico
  • 🚀 Pontuação de risco com reconhecimento de função e alocação dinâmica de permissão
  • 🚀 Propagação de contaminação e auditoria de sistema de ponta a ponta

Legenda: ✅ Concluído | 🚀 Em Andamento

Agradecimentos

Agradecemos a todos os contribuidores deste repositório. São eles: Qi Li, Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Yue Xiao, Rennai Qiu, Zhuoheng Zou, Jiaqi Bai, Jiaxing Song e Ke Xu.

Baixar ferramenta
🏗️ Camada de Verificação de Fundação
Confiança na cadeia de suprimentos e integridade da base
🧼 Camada de Saneamento de EntradaDetecção de injeção de prompt e jailbreak
🧠 Camada de Proteção CognitivaEnvenenamento de memória e desvio de contexto
🎯 Camada de Alinhamento de DecisãoConsistência de intenção antes da ação
🔧 Camada de Controle de ExecuçãoProteções para operações de alto risco