
Прокси-сервер, который оборачивает MCP-серверы с профилированием поведения, сканированием безопасности, контролем рисков и безопасным выполнением. Обнаруживает внедрение промптов, вредоносные метаданные инструментов, внедрение аргументов, риски исходного кода и раскрытие учетных данных.
MCP Safety Warden — это прокси-сервер, который оборачивает любой MCP-сервер и добавляет к его инструментам поведенческое профилирование, сканирование безопасности, контроль рисков и безопасное выполнение.
[!IMPORTANT] Безопасность MCP — активная область исследований. Недавние обзоры каталогизируют множество категорий угроз, специфичных для протокола, включая отравление инструментов, инъекции подсказок, атаки rug-pull, компрометацию цепочки поставок, кражу учётных данных и композиционные атаки на протяжении всего жизненного цикла сервера. См. Securing the MCP (OpenReview), Landscape & Threats (arXiv), When MCP Servers Attack (arXiv) и MCP-38 Taxonomy (arXiv).
Используйте как прокси для добавления контроля безопасности к любому MCP-серверу или направьте его на сервер, которым вы не владеете, и выполните полный аудит безопасности без единого вызова инструмента.
Рис. 1. Два режима работы: прокси и аудит
Поведенческое профилирование: Класс эффекта, безопасность повторных попыток, деструктивность. С помощью LLM (Anthropic, OpenAI, Gemini, Ollama) с резервным правиловым режимом. Наблюдаемая статистика (латентность p50/p95, доля отказов, размер вывода) обновляется после каждого проксированного вызова.
Сканирование безопасности: mcpsafety+ пятиэтапный конвейер (Recon, Planner, Hacker, Auditor, Supervisor). Cisco AI Defense (AST/YARA). Snyk (анализ метаданных). Интеграции с Kali и Burp Suite обогащают конвейер реальными данными сети и HTTP-зондированием. Сканирование исходного кода из GitHub с обнаружением энтропии, AST, потоков заражения и атак rug-pull.
Рис. 2. Пятиэтапный конвейер mcpsafety+, запускаемый при полном аудите безопасности любого MCP-сервера
Безопасное выполнение: Сканирование аргументов (более 20 категорий атак, второй проход с LLM). Двухуровневое сканирование инъекций вывода. Контроль рисков с альтернативами и политиками для каждого инструмента. Обнаружение отклонений при каждом вызове и отдельной проверке.
Рис. 3. Конвейер безопасного выполнения: пять проверок, через которые проходит каждый проксированный вызов инструмента
CLI: 24 подкоманды, интерактивное меню рисков, флаг --json для каждой команды, --yes для CI.
Что он обнаруживает