
Server proxy che avvolge i server MCP con profilazione comportamentale, scansione di sicurezza, controllo dei rischi ed esecuzione sicura. Rileva l'iniezione di prompt, metadati di strumenti malevoli, iniezione di argomenti, rischi del codice sorgente ed esposizione di credenziali.
MCP Safety Warden è un server proxy che avvolge qualsiasi server MCP e aggiunge profilazione comportamentale, scansione di sicurezza, gating del rischio ed esecuzione sicura ai suoi strumenti.
[!IMPORTANTE] La sicurezza MCP è un'area di ricerca attiva. Recenti studi catalogano numerose categorie di minacce specifiche del protocollo, che spaziano da avvelenamento degli strumenti, iniezione di prompt, attacchi rug-pull, compromissione della supply chain, esfiltrazione di credenziali e attacchi di composizione lungo l'intero ciclo di vita del server. Vedi Securing the MCP (OpenReview), Landscape & Threats (arXiv), When MCP Servers Attack (arXiv) e MCP-38 Taxonomy (arXiv).
Utilizzalo come proxy per aggiungere gating di sicurezza a qualsiasi server MCP, oppure puntalo verso un server che non possiedi ed esegui un audit di sicurezza completo senza effettuare alcuna chiamata a uno strumento.
Fig. 1. Due modalità operative: proxy e audit
Profilazione comportamentale: Classe di effetto, sicurezza di ripetizione, distruttività. Assistita da LLM (Anthropic, OpenAI, Gemini, Ollama) con fallback basato su regole. Statistiche osservate (latenza p50/p95, tasso di fallimento, dimensione output) aggiornate dopo ogni chiamata proxy.
Scansione di sicurezza: pipeline mcpsafety+ a cinque fasi (Recon, Planner, Hacker, Auditor, Supervisor). Cisco AI Defense (AST/YARA). Snyk (analisi dei metadati). Le integrazioni con Kali e Burp Suite arricchiscono la pipeline con dati di rete reali e sonde a livello HTTP. Scansione del codice sorgente da GitHub con rilevamento di entropia, AST, flusso di taint e rug-pull.
Fig. 2. Pipeline mcpsafety+ a cinque fasi, attivata quando si esegue un audit di sicurezza completo su qualsiasi server MCP
Esecuzione sicura: Scansione degli argomenti (20+ categorie di attacco, secondo passaggio LLM). Scansione dell'iniezione di output a due livelli. Gating del rischio con alternative e policy per strumento. Rilevamento della deriva (drift) su ogni chiamata e controllo autonomo.
Fig. 3. Pipeline di esecuzione sicura: i cinque controlli che ogni chiamata proxy a uno strumento deve superare
CLI: 24 sottocomandi, menu interattivo del rischio, flag --json su ogni comando, --yes per CI.
Cosa rileva