
Полнофункциональная ОС безопасности для AI-агентов с пятиуровневой архитектурой глубокоэшелонированной защиты, охватывающей сканирование базовых параметров, санитацию входных данных, защиту когнитивных функций, согласование решений и контроль выполнения.
AgentWard (玄甲) — это полноценная операционная система безопасности, созданная для надёжного и масштабируемого развёртывания AI-агентов с нативной адаптацией кода к OpenClaw. AgentWard объединяет внедрение агентов, безопасное рассуждение и доверенное выполнение в единую целостную архитектуру безопасности с предстоящей нативной поддержкой других ведущих мейнстримных фреймворков для агентов. Его гетерогенная архитектура глубокоэшелонированной защиты перестраивает рабочий процесс агента в пять скоординированных уровней безопасности, охватывающих запуск, восприятие, память, принятие решений и выполнение, с динамической кросс-этапной защитой, которая проверяет целостность основы, блокирует состязательный обман, предотвращает вмешательство в память и проверяет каждое автономное решение и высокорискованную команду — замкнутый, сквозной цикл безопасности, реализующий принцип «доверен при создании, контролируем на всём протяжении, надёжен в результатах». Если вы считаете этот репозиторий полезным, процитируйте нашу статью о дизайне архитектуры AgentWard:
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents},
author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
year={2026},
eprint={2604.24657},
archivePrefix={arXiv},
primaryClass={cs.CR},
url={https://arxiv.org/abs/2604.24657},
}
⚡ Установка или обновление
# Запустите скрипт настройки
bash /path/to/agent-ward/setup.sh
✅ Проверьте установку
openclaw plugins list
Затем наслаждайтесь улучшенной безопасностью для вашего OpenClaw!
AgentWard нативно и глубоко интегрирован с платформой OpenClaw и встраивает нативные возможности безопасности в полный жизненный цикл AI-агентов. Его гетерогенная архитектура глубокоэшелонированной защиты перестраивает изолированные точечные проверки безопасности в замкнутую, скоординированную систему защиты на уровне системы, обеспечивая сквозную, полную доверенную гарантию для AI-агентов от запуска до выполнения.

AgentWard обеспечивает безопасность на системном уровне через пять тесно интегрированных уровней, работающих совместно — превращая изолированные проверки безопасности в единую, сквозную систему защиты для AI-агентов.
| Уровень | Направленность |
|---|---|
Гарантирует, что агент стартует с доверенной основы.
Английская версия | Китайская версия |
Выявляет состязательные входные данные до того, как они проникнут в агента.
Английская версия | Китайская версия |
Защищает долговременную память и контекстную непрерывность от отравления.
Английская версия | Китайская версия |
Обеспечивает соответствие решений агента авторизованному намерению пользователя.
Английская версия | Китайская версия |
Устанавливает границы безопасности в точке выполнения.
Английская версия | Китайская версия |
Наша дорожная карта построена на многоуровневой архитектуре защиты, предназначенной для обеспечения безопасности всего жизненного цикла агента: от конфигурации и обработки ввода до когнитивных процессов, принятия решений и выполнения.
Легенда: ✅ Завершено | 🚀 В процессе
Мы благодарим всех контрибьюторов этого репозитория: Qi Li, Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Yue Xiao, Rennai Qiu, Zhuoheng Zou, Jiaqi Bai, Jiaxing Song и Ke Xu.
| 🏗️ Уровень сканирования основы |
| Доверие к цепочке поставок и целостность базовой линии |
| 🧼 Уровень санитации ввода | Обнаружение инъекций подсказок и джейлбрейков |
| 🧠 Уровень защиты когнитивных процессов | Отравление памяти и дрейф контекста |
| 🎯 Уровень выравнивания решений | Согласованность намерений перед действием |
| 🔧 Уровень контроля выполнения | Ограничения для высокорисковых операций |