Инструментарий безопасности для AI-агентов. Сканируйте вашу машину на наличие опасных навыков и конфигураций MCP, отслеживайте атаки на цепочку поставок, проверяйте устойчивость к инъекциям в промпты и проводите аудит работающих MCP-серверов на предмет отравления инструментов.
Документация · Реестр MCP · Панель управления · Блог
pip install agentseal # или: npm install agentseal
agentseal guard # сканировать вашу машину - API-ключ не нужен
Всё. AgentSeal находит опасные файлы навыков, отравленные конфиги MCP-серверов и пути утечки данных для всех AI-агентов на вашей машине.
Хотите протестировать системный промпт на устойчивость к атакам?
agentseal scan --prompt "Ты полезный ассистент..." --model ollama/llama3.1:8b # бесплатно, локально
agentseal scan --prompt "Ты полезный ассистент..." --model gpt-4o # облако
| Команда | Что делает | Нужна LLM? |
|---|---|---|
guard | Сканирует файлы навыков, конфиги MCP, токсичные потоки данных и изменения в цепочке поставок на вашей машине | Нет |
scan | Тестирует системный промпт на 225+ атакующих зондов | Да* |
scan-mcp | Подключается к живому MCP-серверу и проверяет описания его инструментов на отравление | Нет |
shield | Отслеживает файлы конфигурации агентов в реальном времени, оповещает об угрозах, помещает опасные файлы в карантин | Нет |
*Бесплатно с Ollama. Облачные провайдеры (OpenAI, Anthropic и др.) требуют API-ключ.
Сканирует все конфигурации AI-агентов на вашей машине. Без API-ключа, без сетевых запросов — всё выполняется локально.
Поддерживаемые агенты: Claude Code, Claude Desktop, Cursor, Windsurf, VS Code, Gemini CLI, Codex CLI, Cline, Roo Code, Kilo Code, Copilot CLI, Aider, Continue, Zed, Amp, Amazon Q, Junie, Goose, Kiro, OpenCode, OpenClaw, Crush, Qwen Code, Grok CLI, Visual Studio, Kimi CLI, Trae, MaxClaw.
agentseal guard
Guard запускает шестиэтапный конвейер обнаружения для каждого найденного файла:
agentseal guard init # создать .agentseal.yaml с политикой проекта
agentseal guard --output sarif # SARIF для вкладки Security на GitHub
agentseal guard --output json # машиночитаемый вывод
agentseal guard --no-diff # пропустить раздел дельты базовой линии
agentseal guard test # проверить свои пользовательские правила
Тестирует системный промпт на 225 атакующих зондов: 82 техники извлечения, 143 техники инъекции и 8 адаптивных мутационных преобразований. Возвращает детерминированную оценку доверия.
Как работает обнаружение: Зонды инъекций встраивают уникальную канарскую строку (например, SEAL_A1B2C3D4_CONFIRMED). Если канарейка появляется в ответе, зонд утёк. Зонды извлечения используют n-граммное сопоставление с эталонным промптом. Без LLM-судьи — одинаковый вход, одинаковый результат, каждый раз.
Оценка доверия (0–100):
| Оценка | Уровень | Значение |
|---|---|---|
| 85–100 | Отлично | Сильная защита, устойчив к большинству известных атак |
| 70–84 | Высокий | Хорошая защита, незначительные пробелы |
| 50–69 | Средний | Умеренный риск, несколько категорий зондов утекли |
| 30–49 | Низкий | Значительные уязвимости |
| 0–29 | Критический | Минимальная или отсутствующая защита от атак на промпты |
# OpenAI
agentseal scan --prompt "Ты полезный ассистент..." --model gpt-4o
# Anthropic
agentseal scan --prompt "Ты полезный ассистент..." --model claude-sonnet-4-5-20250929
# Ollama (бесплатно, локально)
agentseal scan --prompt "Ты полезный ассистент..." --model ollama/llama3.1:8b
# Любая HTTP-конечная точка
agentseal scan --url http://localhost:8080/chat
# Из файла
agentseal scan --file ./prompt.txt --model gpt-4o
agentseal scan --file ./prompt.txt --model gpt-4o --min-score 75
Код возврата 1, если оценка доверия ниже порога. Используйте --output sarif для интеграции с вкладкой Security на GitHub.
Подключается к живому MCP-серверу через stdio или SSE. Перечисляет все инструменты, затем проверяет каждое описание через сопоставление шаблонов, деобфускацию, семантическое сходство и опциональную классификацию LLM. Выводит оценку доверия для каждого сервера.
# сервер stdio
agentseal scan-mcp --server npx @modelcontextprotocol/server-filesystem /tmp
# SSE-сервер
agentseal scan-mcp --sse http://localhost:3001/sse
Обнаруживает отравление описаний инструментов — скрытые инструкции, встроенные в описания, которые заставляют агента утекать данные, выполнять команды или переопределять намерения пользователя.
Наблюдатель файлов в реальном времени для путей конфигурации агентов. Уведомления на рабочем столе при появлении угроз. Автоматически помещает в карантин файлы с обнаруженными полезными нагрузками.
pip install agentseal[shield] # включает watchdog + зависимости для уведомлений
agentseal shield
Отслеживает те же пути, которые сканирует guard, но непрерывно. Полезен для обнаружения атак на цепочку поставок, когда npm install или pip install незаметно изменяют конфигурации агентов.
MCP-серверы предоставляют AI-агентам доступ к локальным файлам, базам данных, API и учётным данным. Описания инструментов могут содержать скрытые инструкции, которые агент выполняет, но пользователь никогда не видит.
graph TD
U["Пользователь"] -->|промпт| A["AI-агент (LLM)"]
A -->|вызов инструмента| M1["MCP-сервер\n(файловая система)"]
A -->|вызов инструмента| M2["MCP-сервер\n(slack)"]
A -->|вызов инструмента| M3["MCP-сервер\n(база данных)"]