🔐 Guardian

Guardian é um framework de automação de testes de penetração com IA de nível empresarial que combina múltiplos provedores de IA (OpenAI GPT-4, Claude, Google Gemini, OpenRouter, Requesty) com ferramentas de segurança testadas em batalha para fornecer avaliações de segurança inteligentes e adaptáveis com captura abrangente de evidências.
Funcionalidades • Instalação • Início Rápido • Documentação • Contribuir
⚠️ Aviso Legal
Guardian foi projetado exclusivamente para testes de segurança autorizados e fins educacionais.
- ✅ Uso Legal: Testes de penetração autorizados, pesquisa de segurança, ambientes educacionais
- ❌ Uso Ilegal: Acesso não autorizado, atividades maliciosas, qualquer forma de ataque cibernético
Você é totalmente responsável por garantir que possui permissão explícita por escrito antes de testar qualquer sistema. O acesso não autorizado a sistemas de computador é ilegal sob leis como a Lei de Fraude e Abuso de Computador (CFAA), o GDPR e legislação internacional equivalente.
Ao usar o Guardian, você concorda em usá-lo apenas em sistemas que possui ou para os quais tem autorização explícita para testar.
✨ Funcionalidades
- 7 Provedores de IA Suportados: OpenAI (GPT-4o), Anthropic (Claude), Google (Gemini), OpenRouter, Requesty, Ollama (local), Compatível com OpenAI (vLLM, LM Studio, Together, Groq)
- Contrato de Provedor de Plugin: Provedores terceiros são integrados via
[project.entry-points."guardian.providers"] — sem necessidade de fork
- Arquitetura Multi-Agente: Agentes de IA especializados (Planejador, Seletor de Ferramentas, Analista, Relator) além de funções de triagem de debate (Advogado Vermelho, Advogado Azul, Juiz) e Triagem Visual
- Triagem de Debate Multi-Agente: Debate de três funções (vermelho/azul/juiz) sobre descobertas ambíguas — F1 ≥ linha de base de agente único +5pp
- Triagem Visual com Vision-LLM: Captura de screenshot headless + enriquecimento de analista baseado em imagens via gpt-4o / Claude 3.5+ / Gemini 1.5+
- Base de Conhecimento RAG: Recuperação fundamentada via SQLite + FTS5 sobre feeds CVE / CWE / MITRE ATT&CK — elimina referências a CVEs alucinadas
- Roteamento de Modelo Juiz:
think_deeply troca-e-restaura — modelo grande pensa, modelo pequeno julga, redução de custo de ~10x
- Seleção de Ferramentas Aprendida: Classificador offline treinado com telemetria de sessão; abstém-se quando a confiança é baixa e recai no seletor LLM
- Testes Adaptativos: IA ajusta táticas com base em vulnerabilidades descobertas e rendimento anterior de ferramentas
- Filtragem de Falsos Positivos: Triagem de debate reduz ruído; caminho barato é ignorado quando a probabilidade de fp é decisiva
🛠️ Arsenal Extensivo de Ferramentas
50 Ferramentas de Segurança Integradas em 10 categorias:
| Categoria | Ferramentas |
|---|
| Rede | nmap, masscan |
| Reconhecimento Web | httpx, whatweb, wafw00f, cmseek |
| Subdomínio / DNS | subfinder, amass, dnsrecon |
| Varredura de Vulnerabilidades | nuclei, nikto, sqlmap, wpscan |
| Testes SSL/TLS | testssl, sslyze |
| Descoberta de Conteúdo | gobuster, ffuf, arjun |
| Análise de Segurança | xsstrike, gitleaks |
| Nuvem / Contêiner / SBOM | trivy, grype, syft, scoutsuite, prowler, kube-bench |
| Web Moderna + OSINT | graphw00f, clairvoyance, jwt_tool, shodan, theharvester |
| SAST + Segredos (B11) | semgrep, trufflehog, dependency-check |
| Fuzzers de API (B10) | schemathesis, cariddi, restler |
| Ponte Burp/ZAP (B13) | zap, burp |
| Red-Team de LLM (B12) | garak, pyrit, prompt_fuzz |
| Android Móvel (B9) | mobsf, apkleaks, objection |
| Active Directory (B8) | crackmapexec, bloodhound, kerbrute, impacket-secretsdump |
| Evidência Visual (A3) | playwright_screenshot |
📊 Captura Aprimorada de Evidências
- Rastreabilidade de Execução: Cada descoberta vinculada à execução da ferramenta de origem via
execution_id
- Histórico Completo de Comandos: Saída completa da ferramenta preservada com cada descoberta
- Armazenamento de Evidências Brutas: Trechos de saída vinculados às descobertas
- Evidências Visuais: Screenshots capturados por URL, anexados a descobertas web
- Reconstrução de Sessão:
session_<id>.json com checkpoint atômico permite --resume
🔄 Sistema de Workflow Inteligente (DSL v2)
- Agendador DAG: Etapas com
depends_on executam em paralelo até max_parallel_tools
- Templates Jinja2 (sandboxed):
parameters: {key: "{{ <id>.parsed.alive_hosts }}"} resolve com base nos resultados de etapas anteriores
- Etapas Condicionais: Cláusulas
when: controlam a execução com base na saída anterior
- Retomada:
--resume retoma após a última etapa concluída
- Prioridade de Parâmetros: YAML do Workflow > bloco de configuração > padrões da ferramenta
- Agentes Personalizados:
agent: debate | visual | analyst em etapas de análise
- Múltiplos Formatos de Relatório: Markdown, HTML, JSON
📤 Integrações de Saída (B14)
- SARIF v2.1.0: Amigável ao GitHub, inclui
security-severity, fingerprints de dedup a partir de execution_id
- DefectDojo: Upload REST direto
- Slack: Webhook com código de cores baseado na gravidade
- Acionado via:
guardian report --export sarif --export defectdojo --export slack
- Validação de Escopo por Resolução DNS: Fecha bypass de classe SSRF; intervalos privados RFC1918 na lista negra
- Defesa contra Injeção de Prompt: Toda saída de ferramenta encapsulada via delimitadores
<UNTRUSTED_TOOL_OUTPUT> + remoção de ANSI
- Ofuscação de Chaves de API: Logs e relatórios redigem segredos no momento da escrita
- Portão de Confirmação: Ferramentas ativas+ (intrusivas/destrutivas) exigem aprovação explícita do usuário
- Registro de Auditoria: Logs rotativos de cada decisão e ação da IA
- Modo Seguro: Impede ações destrutivas por padrão
📋 Relatórios Profissionais
- Recálculo CVSS v3.1: Valida pontuações reivindicadas contra a matemática do vetor; sinaliza discrepâncias
- Resumos Executivos: Visões gerais não técnicas
- Análises Técnicas Aprofundadas: Descobertas com evidências, CVSS, CWE, CVE, técnica MITRE
- Rastros de Decisão da IA: Uso de tokens, custo, cadeia de pensamento por agente
- Seções de Triagem Visual: Enriquecimento baseado em imagens incorporado nas descrições
⚡ Desempenho e Eficiência
- Assíncrono em Toda Parte: Execução de ferramentas via subprocesso
asyncio; agentes assíncronos
- Carregamento Preguiçoso de Ferramentas: 50 ferramentas registradas, nenhuma importada até ser necessária —
--help permanece abaixo de 500ms
- Execução DAG Paralela: Etapas independentes executam concorrentemente por geração
- Automação de Workflow: 13+ workflows fornecidos (reconhecimento, web, rede, AD, móvel, red-team LLM, SAST, API)
📋 Pré-requisitos
Necessários