Инструменты для хакинга, пентеста и кибербезопасности — ваш арсенал защиты!
AgentWard — Полнофункциональная ОС безопасности для AI-агентов с пятиуровневой архитектурой глубокоэшелонированной защиты, охватывающей сканирование базовых параметров, санитацию входных данных, защиту когнитивных функций, согласование решений и контроль выполнения. | Kitploit
Полнофункциональная ОС безопасности для AI-агентов с пятиуровневой архитектурой глубокоэшелонированной защиты, охватывающей сканирование базовых параметров, санитацию входных данных, защиту когнитивных функций, согласование решений и контроль выполнения.
AgentWard (玄甲) — это полноценная операционная система безопасности, созданная для надёжного и масштабируемого развёртывания AI-агентов с нативной адаптацией кода к OpenClaw. AgentWard объединяет внедрение агентов, безопасное рассуждение и доверенное выполнение в единую целостную архитектуру безопасности с предстоящей нативной поддержкой других ведущих мейнстримных фреймворков для агентов. Его гетерогенная архитектура глубокоэшелонированной защиты перестраивает рабочий процесс агента в пять скоординированных уровней безопасности, охватывающих запуск, восприятие, память, принятие решений и выполнение, с динамической кросс-этапной защитой, которая проверяет целостность основы, блокирует состязательный обман, предотвращает вмешательство в память и проверяет каждое автономное решение и высокорискованную команду — замкнутый, сквозной цикл безопасности, реализующий принцип «доверен при создании, контролируем на всём протяжении, надёжен в результатах». Если вы считаете этот репозиторий полезным, процитируйте нашу статью о дизайне архитектуры AgentWard:
root@kitploit:~
@misc{zhang2026agentwardlifecyclesecurityarchitecture,
title={AgentWard: A Lifecycle Security Architecture for Autonomous AI Agents},
author={Yixiang Zhang and Xinhao Deng and Jiaqing Wu and Yue Xiao and Ke Xu and Qi Li},
year={2026},
eprint={2604.24657},
archivePrefix={arXiv},
primaryClass={cs.CR},
url={https://arxiv.org/abs/2604.24657},
}
Зачем AgentWard
🛡️ Комплексное покрытие рисков — Гетерогенная архитектура глубокоэшелонированной защиты (DiD) обеспечивает полномасштабную гарантию безопасности агентов, блокируя разнообразные векторы атак по всей поверхности атаки агента.
⚡ Развёртывание в один клик — Плагин-ориентированный дизайн встраивает безопасность нативно во весь жизненный цикл агента. Включите комплексную защиту агента одним кликом с помощью неинвазивной интеграции, гарантирующей бесшовную и быструю адаптацию версий для OpenClaw.
🔒 Детерминированные системные контроли — Обеспечивает детерминированные, полностью аудируемые, реализованные программно механизмы безопасности, превосходящие решения на основе навыков, опирающиеся на эндогенную безопасность, с нативной поддержкой крупномасштабного развёртывания и готовности к промышленной эксплуатации.
🌐 Открытый и расширяемый стандарт безопасности — Открытый стандарт, управляемый сообществом, прозрачный и аудируемый, с модульной архитектурой, предназначенной для расширяемости. Построен с полным разделением фреймворка и алгоритмов для лёгкой интеграции передовых алгоритмов обнаружения, с дорожной картой по расширению поддержки на общие агентные системы.
Затем наслаждайтесь улучшенной безопасностью для вашего OpenClaw!
Системная архитектура
AgentWard нативно и глубоко интегрирован с платформой OpenClaw и встраивает нативные возможности безопасности в полный жизненный цикл AI-агентов. Его гетерогенная архитектура глубокоэшелонированной защиты перестраивает изолированные точечные проверки безопасности в замкнутую, скоординированную систему защиты на уровне системы, обеспечивая сквозную, полную доверенную гарантию для AI-агентов от запуска до выполнения.
Пять скоординированных уровней защиты
AgentWard обеспечивает безопасность на системном уровне через пять тесно интегрированных уровней, работающих совместно — превращая изолированные проверки безопасности в единую, сквозную систему защиты для AI-агентов.
Уровень
Направленность
🏗️ Уровень сканирования основы
Доверие к цепочке поставок и целостность базовой линии
🧼 Уровень санитации ввода
Обнаружение инъекций подсказок и джейлбрейков
🧠 Уровень защиты когнитивных процессов
Отравление памяти и дрейф контекста
🎯 Уровень выравнивания решений
Согласованность намерений перед действием
🔧 Уровень контроля выполнения
Ограничения для высокорисковых операций
🚨 Реагирование на угрозы и смягчение последствий
📢 Отправка оповещений через IM при обнаружении угроз
🛑 Автоматическая блокировка опасных операций без участия человека
📝 Чёткие предупреждающие описания для понимания рисков
⚙️ Гибкая конфигурация
🎚️ Каждый уровень защиты может быть включён/отключён независимо
👁️ Поддерживается режим «только обнаружение» для снижения влияния ложных срабатываний
📋 Некоторые уровни поддерживают пользовательские правила для удовлетворения специфических сценариев
Визуализация защиты
🏗️ Уровень 1: Сканирование основы
Гарантирует, что агент стартует с доверенной основы.
Английская версия
Китайская версия
🧼 Уровень 2: Санитация ввода
Выявляет состязательные входные данные до того, как они проникнут в агента.
Английская версия
Китайская версия
🧠 Уровень 3: Защита когнитивных процессов
Защищает долговременную память и контекстную непрерывность от отравления.
Английская версия
Китайская версия
🎯 Уровень 4: Выравнивание решений
Обеспечивает соответствие решений агента авторизованному намерению пользователя.
Английская версия
Китайская версия
🔧 Уровень 5: Контроль выполнения
Устанавливает границы безопасности в точке выполнения.
Английская версия
Китайская версия
Дорожная карта
🏆 Сквозная полностековая система безопасности
Наша дорожная карта построена на многоуровневой архитектуре защиты, предназначенной для обеспечения безопасности всего жизненного цикла агента: от конфигурации и обработки ввода до когнитивных процессов, принятия решений и выполнения.
📐 Базовая инфраструктура системы
✅ Плагин-нативная модульная архитектура
✅ Базовый набор адаптеров
✅ Основной движок обнаружения
✅ Модуль обнаружения на основе эвристических правил
✅ Система оценки риска намерений
🚀 Возможности оценки риска с учётом доверия
🚀 Поддержка гетерогенных ОС
✅ Linux
🚀 macOS
🚀 Windows
🏗️ Уровень сканирования основы
✅ Проверки безопасности глобальной и плагиновой конфигурации
✅ Семантическое обнаружение вредоносных навыков
🚀 Верификация источника навыков
🚀 Анализ зависимостей плагинов
🚀 Гибридное обнаружение уязвимостей в естественном языке и коде
🧼 Уровень санитации ввода
✅ Обнаружение инъекций и джейлбрейков на основе правил
✅ Анализ семантической согласованности пользовательского ввода
🚀 Безопасная перезапись и замена вредоносного контента
🚀 Обнаружение мультимодальных инъекционных атак
🧠 Уровень защиты когнитивных процессов
✅ Оценка и калибровка согласованности памяти
🚀 Построение корпуса вредоносной памяти и сопоставление угроз
🚀 Векторизация памяти и обнаружение выбросов
🚀 Восстановление памяти на основе контрольных точек
🚀 Обнаружение и коррекция дрейфа контекста
🎯 Уровень выравнивания решений
✅ Проверка согласованности решений агента с намерением пользователя
🚀 Фильтрация по статическим правилам и проверка соответствия
🚀 Аудит рассуждений по многошаговой траектории
🚀 Риск-адаптивное динамическое распределение прав
🚀 Идентификация высокорисковых действий и безопасная перезапись
🔧 Уровень контроля выполнения
✅ Перехват и блокировка высокорисковых системных инструкций в реальном времени
✅ Анализ поведенческих намерений и оценка риска
🚀 Динамическое управление правами и ограничение доступа с учётом идентичности
🚀 Предварительная проверка безопасности действий агента
🚀 Автоматический откат и восстановление при аномальных состояниях выполнения
🚀 Прозрачность на системном уровне на базе eBPF
🚀 Мониторинг ресурсов в реальном времени и адаптивное ограничение
🚀 Аудит сетевых полезных нагрузок и обнаружение аномалий
🤝 Межуровневое взаимодействие
✅ Глобальная агрегация информации и обнаружение рисков
🚀 Профилирование доверия на основе истории поведения
🚀 Оценка риска с учётом роли и динамическое распределение прав
🚀 Распространение меток и сквозной аудит системы
Легенда: ✅ Завершено | 🚀 В процессе
Благодарности
Мы благодарим всех контрибьюторов этого репозитория: Qi Li, Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Yue Xiao, Rennai Qiu, Zhuoheng Zou, Jiaqi Bai, Jiaxing Song и Ke Xu.