🔐 Guardian

Guardian è un framework di automazione per penetration testing di livello enterprise basato su IA che combina molteplici provider AI (OpenAI GPT-4, Claude, Google Gemini, OpenRouter, Requesty) con strumenti di sicurezza collaudati sul campo per fornire valutazioni di sicurezza intelligenti e adattive con acquisizione completa di prove.
Funzionalità • Installazione • Avvio rapido • Documentazione • Contribuisci
⚠️ Avviso Legale
Guardian è progettato esclusivamente per test di sicurezza autorizzati e scopi educativi.
- ✅ Uso legale: Penetration testing autorizzato, ricerca sulla sicurezza, ambienti educativi
- ❌ Uso illegale: Accesso non autorizzato, attività dannose, qualsiasi forma di attacco informatico
Sei pienamente responsabile di assicurarti di avere un'autorizzazione scritta esplicita prima di testare qualsiasi sistema. L'accesso non autorizzato a sistemi informatici è illegale secondo leggi come il Computer Fraud and Abuse Act (CFAA), il GDPR e la legislazione internazionale equivalente.
Utilizzando Guardian, accetti di usarlo solo su sistemi di tua proprietà o per i quali hai esplicita autorizzazione al test.
✨ Funzionalità
🤖 Intelligenza AI Multi-Provider
- 7 Provider AI Supportati: OpenAI (GPT-4o), Anthropic (Claude), Google (Gemini), OpenRouter, Requesty, Ollama (locale), Compatibile OpenAI (vLLM, LM Studio, Together, Groq)
- Contratto Provider Plugin: Provider terze parti distribuiscono tramite
[project.entry-points."guardian.providers"] — nessun fork richiesto
- Architettura Multi-Agente: Agenti AI specializzati (Pianificatore, Selettore di Strumenti, Analista, Reporter) più ruoli di triage con dibattito (Avvocato Rosso, Avvocato Blu, Giudice) e Triage Visivo
- Triage con Dibattito Multi-Agente: Dibattito a tre ruoli (rosso/blu/giudice) su risultati ambigui — F1 ≥ baseline singolo agente +5pp
- Triage Visivo con Vision-LLM: Acquisizione di screenshot headless + arricchimento analista basato su immagini tramite gpt-4o / Claude 3.5+ / Gemini 1.5+
- Base di Conoscenza RAG: Recupero groundato SQLite + FTS5 su feed CVE / CWE / MITRE ATT&CK — elimina riferimenti CVE allucinati
- Routing Modello Giudice:
think_deeply swap-and-restore — modello grande pensa, modello piccolo giudica, riduzione dei costi di ~10x
- Selezione Appresa degli Strumenti: Ranker offline addestrato su telemetria di sessione; si astiene quando la fiducia è bassa e torna al selettore LLM
- Test Adattivi: L'IA regola le tattiche in base alle vulnerabilità scoperte e ai risultati precedenti degli strumenti
- Filtraggio Falsi Positivi: Il triage con dibattito riduce il rumore; percorso economico saltato quando fp_probability è decisivo
🛠️ Ampio Arsenale di Strumenti
50 Strumenti di Sicurezza Integrati in 10 Categorie:
| Categoria | Strumenti |
|---|
| Rete | nmap, masscan |
| Ricognizione Web | httpx, whatweb, wafw00f, cmseek |
| Sottodominio / DNS | subfinder, amass, dnsrecon |
| Scansione Vulnerabilità | nuclei, nikto, sqlmap, wpscan |
| Test SSL/TLS | testssl, sslyze |
| Scoperta Contenuti | gobuster, ffuf, arjun |
| Analisi Sicurezza | xsstrike, gitleaks |
| Cloud / Container / SBOM | trivy, grype, syft, scoutsuite, prowler, kube-bench |
| Web Moderno + OSINT | graphw00f, clairvoyance, jwt_tool, shodan, theharvester |
| SAST + Segreti (B11) | semgrep, trufflehog, dependency-check |
| Fuzzer API (B10) | schemathesis, cariddi, restler |
| Ponte Burp/ZAP (B13) | zap, burp |
| Red-Team LLM (B12) | garak, pyrit, prompt_fuzz |
| Mobile Android (B9) | mobsf, apkleaks, objection |
| Active Directory (B8) | crackmapexec, bloodhound, kerbrute, impacket-secretsdump |
| Prove Visive (A3) | playwright_screenshot |
📊 Acquisizione Prove Potenziata
- Tracciabilità dell'Esecuzione: Ogni risultato collegato all'esecuzione dello strumento che lo ha generato tramite
execution_id
- Cronologia Completa dei Comandi: Output completo dello strumento preservato per ogni risultato
- Archiviazione Prove Grezze: Frammenti di output associati ai risultati
- Prove Visive: Screenshot catturati per ogni URL, allegati ai risultati web
- Ricostruzione della Sessione:
session_<id>.json con checkpoint atomico abilita --resume
🔄 Sistema di Workflow Intelligente (DSL v2)
- Scheduler DAG: Passaggi con
depends_on eseguiti in parallelo fino a max_parallel_tools
- Template Jinja2 (in sandbox):
parameters: {key: "{{ <id>.parsed.alive_hosts }}"} risolve sui risultati dei passaggi precedenti
- Passaggi Condizionali: Clausole
when: bloccano l'esecuzione in base all'output precedente
- Ripresa:
--resume riprende dall'ultimo passaggio completato
- Priorità dei Parametri: YAML del workflow > blocco di configurazione > impostazioni predefinite dello strumento
- Agenti Personalizzati:
agent: debate | visual | analyst sui passaggi di analisi
- Formati Report Multipli: Markdown, HTML, JSON
📤 Integrazioni di Output (B14)
- SARIF v2.1.0: Compatibile con GitHub, include
security-severity, deduplicazione fingerprints da execution_id
- DefectDojo: Caricamento REST diretto
- Slack: Webhook con codifica a colori della gravità
- Attivato tramite:
guardian report --export sarif --export defectdojo --export slack
- Convalida dell'ambito tramite risoluzione DNS: Blocca bypass di tipo SSRF; intervalli privati RFC1918 in blacklist
- Difesa da Iniezione di Prompt: Tutto l'output degli strumenti racchiuso da delimitatori
<UNTRUSTED_TOOL_OUTPUT> + rimozione ANSI
- Offuscamento Chiavi API: Log e report oscurano i segreti al momento della scrittura
- Cancello di Conferma: Strumenti Active+ (intrusivi/distruttivi) richiedono approvazione esplicita dell'utente
- Registrazione Audit: Log rotanti di ogni decisione e azione dell'IA
- Modalità Sicura: Impedisce azioni distruttive per impostazione predefinita
📋 Reportistica Professionale
- Ricalcolo CVSS v3.1: Convalida i punteggi dichiarati rispetto alla matematica vettoriale; segnala derive
- Sommari Esecutivi: Panoramiche non tecniche
- Approfondimenti Tecnici: Risultati con prove, CVSS, CWE, CVE, tecnica MITRE
- Tracce delle Decisioni AI: Utilizzo token, costo, registro della catena di pensiero per agente
- Sezioni di Triage Visivo: Arricchimento basato su immagini integrato nelle descrizioni
⚡ Prestazioni ed Efficienza
- Asincrono Ovunque: Esecuzione degli strumenti tramite sottoprocesso
asyncio; agenti asincroni
- Caricamento Pigro degli Strumenti: 50 strumenti registrati, nessuno importato fino al bisogno —
--help rimane sotto 500ms
- Esecuzione DAG Parallela: Passaggi indipendenti eseguiti concurrentemente per generazione
- Automazione dei Workflow: 13+ workflow forniti (recon, web, rete, AD, mobile, red-team LLM, SAST, API)
📋 Prerequisiti
Requisiti