Skip to content
KitploitKITPLOIT
StrumentiBlog
Invia
StrumentiBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

··Feed·Contatto·Privacy·© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
awesome-ai-security — Una raccolta di fantastiche risorse relative alla sicurezza dell'IA | Kitploit
Strumenti/GitHubGitHub/ottosulin/awesome-ai-security
Scanner di VulnerabilitàPenetration TestingPrivacySicurezza della Supply ChainApprendimento e FormazioneRed TeamingRisorse CurateSicurezza dell'IAAttacco Avversario
GitHubottosulin/awesome-ai-security

awesome-ai-security

Una raccolta di fantastiche risorse relative alla sicurezza dell'IA

1.4k35221h 53m faRevisionato da Kitploit

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
Condividi
Vedi Repository

Awesome AI Security Awesome Track Awesome List

Una lista curata di fantastiche risorse relative alla sicurezza dell'AI: framework, standard, materiali di apprendimento e strumenti open source.

Se vuoi contribuire, crea una PR o contattami @ottosulin.

Indice dei contenuti

  • Risorse di apprendimento
    • Letture e guide
    • Corsi, laboratori e CTF
    • Podcast
  • Governance e gestione del rischio
    • Framework
    • Standard e verifica
    • Tassonomie, terminologia e database dei rischi
    • Checklist e guide pratiche
  • Tecniche di attacco e red teaming
    • ML avversariale e modelli classici
    • Red teaming per LLM e GenAI
    • AI agentica e strumenti di attacco MCP
    • Sicurezza offensiva assistita dall'AI
    • Steganografia e canali nascosti
  • Benchmark e valutazioni
  • Difesa e controlli di sicurezza
    • Guardrail input/output
    • Sicurezza del runtime degli agenti e sandboxing
    • Sicurezza MCP
    • Scansione di modelli e artefatti
    • Sicurezza difensiva assistita dall'AI
    • Privacy e confidential computing
    • Sicurezza dei dati e della supply chain
  • Competenze di sicurezza per AI agentica
  • Modelli AI orientati alla sicurezza

Risorse di apprendimento

Letture e guide

  • OWASP ML TOP 10
  • OWASP LLM TOP 10
  • OWASP AI Security and Privacy Guide
  • NIST AIRC - Centro risorse NIST per un'AI affidabile e responsabile
  • The MLSecOps Top 10 by Institute for Ethical AI & Machine Learning
  • OWASP Multi-Agentic System Threat Modeling
  • OWASP: CheatSheet – Una guida pratica per l'uso sicuro di server MCP di terze parti 1.0
  • OWASP GenAI Threat & Defense Compass - Guida di riferimento che mappa le minacce GenAI ai corrispondenti controlli difensivi.
  • Linee guida NCSC per lo sviluppo sicuro di sistemi AI - Linee guida pratiche redatte congiuntamente da NCSC (UK) e CISA per lo sviluppo sicuro dell'AI, coprendo progettazione, sviluppo, distribuzione e gestione.

Corsi, laboratori e CTF

  • Damn Vulnerable MCP Server - Un'implementazione deliberatamente vulnerabile del Model Context Protocol (MCP) a scopo didattico.
  • otto-support - Un'implementazione vulnerabile di un server MCP che utilizza mcp-go con autenticazione a livelli (4 ruoli), 19 strumenti e un container sandbox integrato con Claude Code per esercitarsi nell'escalation dei privilegi e nell'uso improprio degli strumenti.
  • OWASP WrongSecrets LLM exercise
  • vulnerable-mcp-servers-lab - Una raccolta di server deliberatamente vulnerabili per imparare il pentesting dei server MCP.
  • FinBot Agentic AI Capture The Flag (CTF) Application - FinBot è una piattaforma interattiva CTF (Capture The Flag) per la sicurezza agentica che simula vulnerabilità reali nei sistemi AI agentici utilizzando un'applicazione simulata focalizzata sui servizi finanziari.
  • AI-Red-Teaming-Playground-Labs - Laboratori didattici per il red teaming dell'AI, inclusa l'infrastruttura per condurre sessioni di formazione.
  • Damn Vulnerable LLM Agent - Agente LLM intenzionalmente vulnerabile per imparare l'iniezione di prompt, l'uso improprio degli strumenti e la sicurezza degli agenti.
    • LLMVault - Un laboratorio di sicurezza LLM open source in stile CTF per apprendere l'OWASP LLM Top 10 attraverso esercizi pratici vulnerabili che coprono iniezione di prompt, attacchi RAG, perdita del system prompt, uso improprio degli strumenti e sicurezza degli agenti.

Podcast

  • MLSecOps podcast
  • AI Security Podcast
  • AI Security Ops - Podcast settimanali di Black Hills Information Security che esplorano come l'AI trasforma la cybersecurity, coprendo minacce emergenti, strumenti e tendenze con conoscenze pratiche e utilizzabili.
  • GenAI Security podcast

Governance e gestione del rischio

Framework

  • NIST AI Risk Management Framework
  • ISO/IEC 42001 Sistema di gestione dell'intelligenza artificiale
  • ISO/IEC 23894:2023 Information technology — Artificial intelligence — Guida alla gestione del rischio
  • Google Secure AI Framework (SAIF)
  • ENISA Framework multilivello per buone pratiche di cybersecurity per l'AI
  • OWASP Artificial Intelligence Maturity Assessment
  • CSA AI Model Risk Framework
  • CSA Maestro AI Threat Modeling Framework
  • CSA AI Controls Matrix - Matrice di controlli completa per sistemi AI, coprendo governance, rischio e conformità.
  • OWASP Agentic AI Top 10 - Top 10 per l'AI agentica che funge da nucleo per il red teaming di OWASP e CSA.

Standard e verifica

  • OWASP AI Security Verification Standard
  • OWASP Agent Name Service
  • OWASP Agent Observability Standard
  • AI Verify - Framework di test AI sostenuto dal governo di Singapore e toolkit per verificare le proprietà dei sistemi AI rispetto ai framework di governance.

Tassonomie, terminologia e database dei rischi

  • NIST AI 100-2e2023 - Tassonomia e terminologia del machine learning avversariale
  • MITRE ATLAS
    • ATLAS Knowledge Base Agent - Assistente AI open source per esplorare la knowledge base ATLAS con linguaggio naturale, accesso al server MCP e flussi di lavoro agentici personalizzabili.
  • AVIDML
  • MIT AI Risk Repository
  • AI Incident Database
  • ISO/IEC 22989:2022 Information technology — Artificial intelligence — Concetti e terminologia dell'intelligenza artificiale
  • Glossario AI NIST
  • The Arcanum Prompt Injection Taxonomy - Sistema di classificazione completo per attacchi di iniezione di prompt, coprendo intenzioni, tecniche, evasioni e vettori di input. Classifica obiettivi, metodi, tecniche di offuscamento e superfici di attacco per le iniezioni di prompt.
  • CSA LLM Threats Taxonomy
  • OWASP AI Vulnerability Scoring System (AIVSS) - Sistema di valutazione per vulnerabilità specifiche dell'AI, che estende i concetti CVSS alle dimensioni del rischio AI.

Checklist e guide pratiche

  • OWASP LLM Applications Cybersecurity and Governance Checklist
  • OWASP AI Security and Privacy Guide
  • OWASP LLM and Generative AI Security Center of Excellence Guide
  • OWASP Agentic AI – Threats and Mitigations
  • Panoramica sulle soluzioni di sicurezza AI di OWASP
  • Guida alla risposta agli incidenti GenAI di OWASP
  • OWASP LLM and GenAI Data Security Best Practices
  • OWASP Securing Agentic AI Applications
  • Guida al red teaming GenAI di OWASP

Tecniche di attacco e red teaming

ML avversariale e modelli classici

  • Adversarial Robustness Toolkit - ART si concentra sulle minacce di Evasione (modifica del comportamento del modello con modifiche all'input), Avvelenamento (controllo del modello con modifiche ai dati di addestramento), Estrazione (sottrazione del modello tramite query) e Inferenza (attacco alla privacy dei dati di addestramento)
  • cleverhans - Una libreria di esempi avversariali per costruire attacchi, creare difese e confrontare entrambi
  • foolbox - Un toolkit Python per creare esempi avversariali che ingannano le reti neurali in PyTorch, TensorFlow e JAX
  • TextAttack - Un framework Python per attacchi avversariali, data augmentation e addestramento di modelli in NLP
  • Counterfit - Livello di automazione generico per valutare la sicurezza dei sistemi di machine learning
  • OffsecML Playbook - Una raccolta di TTP offensivi e avversariali con proof of concept
  • BadDiffusion - Repo ufficiale per riprodurre l'articolo "How to Backdoor Diffusion Models?" pubblicato a CVPR 2023
  • secml-torch - SecML-Torch: una libreria per la valutazione della robustezza dei modelli di deep learning

Red teaming per LLM e GenAI

  • garak - Strumento di probing della sicurezza per LLM
  • ai-scanner - Applicazione web open source per la valutazione della sicurezza dei modelli AI, basata su NVIDIA garak. Include 179 probe, scansione multi-target, scansioni programmate, punteggio ASR e integrazione SIEM.
  • promptfoo - Testa i tuoi prompt, agenti e RAG. Red teaming, penetration testing e scansione delle vulnerabilità per LLM. Confronta le prestazioni di GPT, Claude, Gemini, Llama e altri. Configurazioni dichiarative semplici con integrazione da riga di comando e CI/CD.
  • PyRIT - Il Python Risk Identification Tool per l'AI generativa (PyRIT) è un framework open source creato per consentire a professionisti della sicurezza e ingegneri di identificare proattivamente i rischi nei sistemi di AI generativa.
  • PurpleLlama - Set di strumenti per valutare e migliorare la sicurezza degli LLM.
  • augustus - Framework di test della sicurezza per LLM per rilevare iniezioni di prompt, jailbreak e attacchi avversariali. 190+ probe, 28 provider, singolo binario Go. Pronto per la produzione con scansione concorrente, limitazione della velocità e logica di retry.
  • FuzzyAI - Un potente strumento per il fuzzing automatico degli LLM. Progettato per aiutare sviluppatori e ricercatori di sicurezza a identificare e mitigare potenziali jailbreak nelle loro API LLM.
  • EasyJailbreak - Un framework Python facile da usare per generare prompt di jailbreak avversariali.
  • gptfuzz - Repo ufficiale per GPTFUZZER: Red Teaming di grandi modelli linguistici con prompt di jailbreak generati automaticamente
  • llamator - Framework per testare le vulnerabilità dei grandi modelli linguistici (LLM).
  • agentic_security - Scanner di vulnerabilità LLM agentico / kit per il red teaming dell'AI

AI agentica e strumenti di attacco MCP

  • RAMPART - Framework di test per la sicurezza e la protezione nativo di pytest per applicazioni AI agentiche.
  • AI-Infra-Guard - Una piattaforma completa, intelligente e facile da usare per il red teaming dell'AI sviluppata dal Tencent Zhuque Lab. Integra moduli per Infra Scan, MCP Scan e Jailbreak Evaluation, fornendo un'interfaccia web con un clic, API REST e distribuzione basata su Docker per una valutazione completa della sicurezza dell'AI.
  • OpenPromptInjection - Un benchmark per attacchi e difese di iniezione di prompt
  • AIMap - Piattaforma di scoperta e test di sicurezza su scala Internet per infrastrutture di agenti AI esposte. Interroga Shodan per server MCP, istanze Ollama, proxy vLLM/LiteLLM e altro, quindi identifica, valuta il rischio e lancia suite di attacco specifiche per protocollo con risultati in streaming in tempo reale.### Sicurezza Offensiva Assistita dall'IA
  • PentestGPT - Uno strumento di penetration testing potenziato da GPT
  • HackingBuddyGPT - Aiutare gli ethical hacker a usare LLM in 50 righe di codice o meno
  • cai - Cybersecurity AI (CAI), un'Intelligenza Artificiale open source pronta per Bug Bounty (paper)
  • shannon - Pentester AI completamente autonomo per app web e API di Keygraph. Test di sicurezza white-box che analizza il codice sorgente, identifica vettori d'attacco ed esegue exploit reali. Tasso di successo del 96.15% (100/104 exploit) sul benchmark XBOW.
  • strix - Strix sono agenti AI autonomi che agiscono esattamente come veri hacker: eseguono il tuo codice dinamicamente, trovano vulnerabilità e le convalidano tramite proof-of-concept reali
  • redamon - Framework red team basato su agenti potenziato dall'IA che automatizza le operazioni di sicurezza offensiva, dalla ricognizione allo sfruttamento alla post-esplorazione, senza intervento umano.

Steganografia e Canali Nascosti

  • ST3GG - Suite di steganografia tutto-in-uno con codifica multi-livello, steganografia di immagini e audio, e strumenti di steganalisi per rilevare dati nascosti in media generati dall'IA.

Benchmark e Valutazioni

  • ISC-Bench - Internal Safety Collapse: jailbreak qualsiasi LLM all'avanguardia (Claude Opus 4.6, GPT-5.4) in pass@3 tramite completamento normale di attività — nessun prompt avversario. Black-box, cross-dominio, cross-scienza. Nuova modalità di fallimento. [Paper]
  • jailbreakbench - JailbreakBench: Un Benchmark Aperto di Robustezza per il Jailbreak di Modelli Linguistici [NeurIPS 2024 Datasets and Benchmarks Track]
  • AgentDojo - Un Ambiente Dinamico per Valutare Attacchi e Difese per Agenti LLM.
  • AIRTBench - Repository del codice per: AIRTBench: Misurare le capacità autonome di Red Teaming AI nei modelli linguistici
  • HackingBuddyGPT benchmark dataset - Dataset di benchmark per il pentesting automatizzato
  • AgentDoG - AgentDoG è un framework di valutazione e protezione sensibile al rischio per agenti autonomi. Si concentra sulla valutazione del rischio a livello di traiettoria, con l'obiettivo di determinare se la traiettoria di esecuzione di un agente contiene rischi per la sicurezza in diversi scenari applicativi.
  • AICGSecEval - Benchmark di valutazione completo di Tencent per la sicurezza della generazione di codice AI, che copre 10 categorie CWE con test automatizzati
  • Inspect - Framework per valutazioni di modelli linguistici di grandi dimensioni dell'UK AI Security Institute. Oltre 200 valutazioni predefinite che coprono ingegneria dei prompt, uso di strumenti, dialoghi multi-turno e punteggio graduato dal modello.
  • sec-code-bench - Benchmark di Alibaba per valutare le capacità di sicurezza del codice degli LLM in 17 categorie di vulnerabilità e 4 linguaggi di programmazione

Controlli di Difesa e Sicurezza

Guardrail di Input/Output

  • NeMo-Guardrails - NeMo Guardrails è un toolkit open-source per aggiungere facilmente guardrail programmabili a sistemi conversazionali basati su LLM.
  • LlamaFirewall - LlamaFirewall è un framework progettato per rilevare e mitigare i rischi di sicurezza incentrati sull'IA, supportando molteplici livelli di input e output, come la tipica chat LLM e operazioni agentiche multistep più avanzate.
  • llm-guard - LLM Guard di Protect AI è uno strumento completo progettato per rafforzare la sicurezza dei Large Language Models (LLM).
  • Guardrails.ai - Guardrails è un pacchetto Python che consente all'utente di aggiungere garanzie di struttura, tipo e qualità agli output dei modelli linguistici di grandi dimensioni (LLM)
  • TrustGate - Generative Application Firewall (GAF) per rilevare, prevenire e bloccare attacchi contro applicazioni GenAI
  • ZenGuard AI - Il livello di fiducia più veloce per agenti AI
  • LocalMod - API di moderazione dei contenuti auto-ospitata con rilevamento di prompt injection, filtraggio della tossicità, rilevamento PII e classificazione NSFW. Funziona completamente offline.
  • DynaGuard - Un modello di guardrail dinamico con policy definite dall'utente
  • AprielGuard - Modello di salvaguardia sicurezza–protezione da 8 miliardi di parametri
  • Safe Zone - Safe Zone è un motore open-source di rilevamento PII e guardrail che impedisce la fuga di dati sensibili verso LLM e API di terze parti.
  • superagent - Superagent fornisce guardrail addestrati per uno scopo specifico che rendono gli agenti AI sicuri e conformi.
  • ShellWard -

Sicurezza del Runtime degli Agenti e Sandboxing

  • OpenShell - OpenShell è il runtime sicuro e privato per agenti AI autonomi. Fornisce ambienti di esecuzione sandboxati governati da policy YAML dichiarative che impediscono l'accesso non autorizzato ai file, l'esfiltrazione di dati e l'attività di rete incontrollata.
  • OpenSandbox - Runtime sandbox sicuro, veloce ed estensibile per agenti AI. SDK multi-linguaggio, runtime Docker/Kubernetes, isolamento gVisor/Kata Containers/Firecracker. Progetto CNCF Landscape.
  • CubeSandbox - Sandbox istantanea, concorrente, sicura e leggera per agenti AI di Tencent Cloud. Avvio a freddo inferiore a 60ms, overhead di memoria <5 MB, compatibile con SDK E2B. Costruita su RustVMM e KVM con isolamento estremo (kernel dedicato + eBPF).
  • Aegis - EDR open-source per agenti AI di Antropos. Monitora in tempo reale processi, file, rete e comportamento di agenti AI autonomi. Nessuna telemetria, nessun cloud, tutto rimane locale.
  • Microsoft Agent Governance Toolkit - AI Agent Governance Toolkit di Microsoft — Applicazione delle policy, identità zero-trust, sandboxing dell'esecuzione e ingegneria dell'affidabilità per agenti AI autonomi. Copre 10/10 OWASP Agentic Top 10.
  • agentfield - Piano di controllo open-source per sistemi di agenti con identità crittografica, applicazione delle policy e osservabilità adatta al controllo.
  • leash - Leash avvolge gli agenti di codifica AI in contenitori e monitora la loro attività.
  • vibekit - Esegui Claude Code, Gemini, Codex — o qualsiasi agente di codifica — in una sandbox pulita e isolata con oscuramento dei dati sensibili e osservabilità integrata.
  • pipelock - Fornitura di sicurezza per agenti AI — proxy di uscita con scansione DLP, protezione SSRF, scansione delle risposte MCP e monitoraggio dell'integrità dell'area di lavoro
  • skill-scanner - Uno scanner di sicurezza per le Skill degli Agenti AI che rileva prompt injection, esfiltrazione di dati e pattern di codice dannoso. Combina rilevamento basato su pattern (YAML + YARA), LLM-as-a-judge e analisi del flusso di dati comportamentale per un rilevamento completo delle minacce.

Sicurezza MCP

  • MCP-Security-Checklist - Una checklist di sicurezza completa per strumenti AI basati su MCP. Realizzata da SlowMist per salvaguardare gli ecosistemi di plugin LLM.
  • Awesome-MCP-Security - Tutto ciò che devi sapere sulla sicurezza del Model Context Protocol (MCP).
  • secure-mcp-gateway - Questo Secure MCP Gateway è costruito con autenticazione, scoperta automatica degli strumenti, caching e applicazione dei guardrail.
  • mcp-context-protector - context-protector è un wrapper di sicurezza per server MCP che affronta i rischi associati all'esecuzione di server MCP non fidati, inclusi line jumping, modifiche impreviste alla configurazione del server e altri attacchi di prompt injection
  • mcp-guardian - MCP Guardian gestisce l'accesso del tuo assistente LLM ai server MCP, dandoti il controllo in tempo reale dell'attività del tuo LLM.
  • MCP Audit VSCode Extension - Controlla e registra centralmente tutte le chiamate agli strumenti MCP di GitHub Copilot in VSCode con facilità.
  • MCP-Scan - Uno strumento di scansione della sicurezza per server MCP
  • ATR (Agent Threat Rules) - Regole di rilevamento open-source per minacce agli agenti AI. 108 regole regex che coprono prompt injection, avvelenamento degli strumenti, esfiltrazione di credenziali in 9 categorie. Utilizzate da Cisco AI Defense. Licenza MIT.
  • MCPProxy - Proxy MCP local-first con quarantena SHA-256 per strumento per rilevare avvelenamento degli strumenti e attacchi rug-pull, scansione automatica di dati sensibili e segreti delle chiamate agli strumenti, isolamento sandbox Docker per server MCP non fidati e OAuth 2.1. Licenza MIT.

Scansione di Modelli e Artefatti

  • modelscan - ModelScan è un progetto open source di Protect AI che scansiona i modelli per determinare se contengono codice non sicuro.
  • picklescan - Scanner di sicurezza che rileva file Python Pickle che eseguono azioni sospette
  • fickling - Un decompilatore e analizzatore statico di pickling Python
  • medusa - Scanner di sicurezza AI-first con oltre 74 analizzatori, oltre 180 regole di sicurezza per agenti AI, riduzione intelligente dei falsi positivi. Supporta tutti i linguaggi. Rilevamento CVE per React2Shell, mcp-remote RCE.
  • julius - Strumento di fingerprinting dei servizi LLM per professionisti della sicurezza. Rileva oltre 32 servizi AI (Ollama, vLLM, LiteLLM, Hugging Face TGI, ecc.) durante i penetration test e la scoperta della superficie d'attacco. Utilizza il fingerprinting dei servizi basato su HTTP per identificare l'infrastruttura del server.
  • a2a-scanner - Scansiona gli agenti A2A per potenziali minacce e problemi di sicurezza### Sicurezza Difensiva Assistita dall'IA
  • Claude Code Security Review - Un'azione GitHub per revisioni di sicurezza alimentata dall'IA che utilizza Claude per analizzare le modifiche al codice alla ricerca di vulnerabilità.
  • deepsec - Scanner di vulnerabilità basato su agenti di Vercel Labs per individuare problemi difficili da individuare in grandi basi di codice utilizzando agenti di codifica. Supporta scansione parallela, revisione delle differenze delle PR e integrazione CI/CD.
  • defending-code-reference-harness - Implementazione di riferimento per la scoperta e la correzione autonoma delle vulnerabilità utilizzando Claude. Include competenze di threat modeling, scansione, triage e patching.
  • Visa Vulnerability Agentic Harness - Pipeline SAST agentica con 11 fasi dalla rilevazione alla correzione tramite LLM e validazione avversaria. Produce output SARIF, si integra con Claude Code, Copilot e Gemini.

Privacy e Calcolo Confidenziale

  • Python Differential Privacy Library
  • Diffprivlib - La libreria di privacy differenziale di IBM
  • TenSEAL - Una libreria per eseguire operazioni di crittografia omomorfica su tensori
  • SyMPC - Una libreria di calcolo multipartito sicuro compagna per Syft
  • Cloaked AI - Crittografia open-source che preserva le proprietà per embedding vettoriali
  • dstack - Framework AI confidenziale open-source per il deployment sicuro di ML/LLM con isolamento imposto dall'hardware e privacy dei dati
  • PrivacyRaven - libreria di test della privacy per sistemi di deep learning
  • PLOT4ai - Libreria di minacce per la privacy nell'intelligenza artificiale — Una libreria di threat modeling per aiutarti a costruire un'IA responsabile
  • OpenDP - Libreria principale per algoritmi di privacy differenziale del progetto OpenDP — utilizzata per costruire pipeline di addestramento ML che preservano la privacy

Sicurezza dei Dati e della Supply Chain

  • datasig - Impronta digitale dei dataset per AIBOM
  • OWASP AIBOM - Distinta base dell'IA (AI Bill of Materials)
  • Trusera ai-bom - Distinta base dell'IA (AI Bill of Materials) — scopri ogni agente, modello e API di IA nella tua infrastruttura

Competenze di Sicurezza Agentica per l'IA

  • Elastic Agent Skills - Raccolta di competenze per l'assistente IA di Elastic, che consente indagini di sicurezza in linguaggio naturale su log, trace e threat intelligence
  • Ghost Security Skills - Competenze e strumenti di sicurezza delle applicazioni (appsec) per agenti per Claude Code
  • tm_skills - Competenze per agenti per aiutare con il Continuous Threat Modeling
  • Trail of Bits Skills Marketplace - Competenze di Trail of Bits per Claude Code per ricerca sulla sicurezza, rilevamento di vulnerabilità e flussi di lavoro di audit
  • Semgrep Skills - Competenze ufficiali di Semgrep per Claude Code e altri assistenti di codifica IA. Fornisce capacità di scansione di sicurezza, analisi del codice e rilevamento di vulnerabilità direttamente nel tuo flusso di lavoro di sviluppo assistito dall'IA.
  • claude-bug-bounty - Competenza per Claude Code per la caccia ai bug assistita dall'IA. Automatizza ricognizione, test IDOR, XSS, SSRF, OAuth, GraphQL e injection LLM con checklist di validazione a 4 fasi e generazione di report.
  • Anthropic Cybersecurity Skills - Oltre 734 competenze strutturate di cybersecurity per agenti IA. Mappate su MITRE ATT&CK, standard agentskills.io. Compatibile con Claude Code, Copilot, Codex CLI, Cursor e Gemini CLI.
  • llm-sast-scanner - Competenza SAST per agenti di codifica IA (Claude Code, Codex, ecc.) con rilevamento strutturato delle vulnerabilità su 34 classi. Caratterizza analisi taint source-to-sink, verifica Judge per la riduzione dei falsi positivi e precision/recall superiori al 99% sui benchmark.
  • sast-skills - Raccolta di competenze per agenti che trasformano il tuo codificatore IA in uno scanner SAST
  • pentest-ai-agents - 31 subagenti per Claude Code per la sicurezza offensiva. Subagenti IA specializzati per ricognizione, web, Active Directory, cloud, mobile, wireless, ingegneria sociale, creazione di payload, reverse engineering, concatenamento di exploit, ingegneria del rilevamento, forensics e generazione di report. Gli agenti di livello 2 possono eseguire direttamente gli strumenti con gate di approvazione.

Modelli IA Focalizzati sulla Sicurezza

  • VulnLLM-R-7B - LLM di ragionamento specializzato per il rilevamento delle vulnerabilità. Utilizza il ragionamento Chain-of-Thought per analizzare il flusso dei dati, il flusso di controllo e il contesto di sicurezza. Supera Claude-3.7-Sonnet e CodeQL nei benchmark di rilevamento delle vulnerabilità. Solo 7 miliardi di parametri, rendendolo efficiente e veloce.
  • Foundation-Sec-8B-Reasoning - Llama-3.1-FoundationAI-SecurityLLM-8B-Reasoning è un modello linguistico open-weight da 8 miliardi di parametri ottimizzato per le istruzioni, specializzato in applicazioni di cybersecurity. Estende il modello base Foundation-Sec-8B con capacità di seguire istruzioni e ragionamento.
  • Antares (1B & 350M) - Modelli agentici per la localizzazione delle vulnerabilità di fdtn-ai. Disponibili in varianti da 2B e 0.4B parametri, progettati per identificare e localizzare autonomamente le vulnerabilità nel codice.
  • CyberSecQwen-4B - _Specialista CTI da 4B parametri ottimizzato da Qwen3-4B-Instruct-2507 per threat intelligence sulla cybersecurity.
  • Meta-SecAlign-8B / Meta-SecAlign-70B - Modelli Llama allineati alla sicurezza ottimizzati per resistere agli attacchi di prompt injection, mantenendo la gerarchia delle istruzioni anche sotto input avversari
  • Lily-Cybersecurity-7B - Modello chat da 7B ottimizzato per la cybersecurity, ottimizzato per analisi di sicurezza, spiegazione delle vulnerabilità e attività di threat intelligence.

Classificatori di Sicurezza e Rilevamento di Prompt Injection

  • Llama-Guard-4-12B - L'ultimo classificatore di sicurezza multimodale di Meta per rilevare contenuti dannosi negli input e output degli LLM in modalità testo e immagine.
  • Llama-Prompt-Guard-2-86M - Modello leggero da 86M parametri di Meta per rilevare tentativi di prompt injection e jailbreak nelle pipeline LLM di produzione.
  • ShieldGemma-2B - Classificatore di sicurezza testuale da 2B parametri di Google per rilevare contenuti dannosi, basato sull'architettura Gemma.
  • DeBERTa Prompt Injection Detector v2 - DeBERTa-v3-base di Protect AI ottimizzato per il rilevamento di prompt injection, ampiamente utilizzato nelle pipeline di guardrail LLM in produzione.
  • Prompt Injection Sentinel - Modello ModernBERT-large ottimizzato per la classificazione di prompt injection e jailbreak con basso tasso di falsi positivi.
  • Nemotron 3.5 Content Safety - Modello di sicurezza dei contenuti multimodale da 4B parametri di NVIDIA che unifica guardrail per input testo+immagine, supporto multilingua (oltre 35 lingue), applicazione di policy aziendali personalizzabili e ragionamento verificabile in una singola chiamata di inferenza. Successore di Nemotron 3 Content Safety.
  • BrowseSafe - Modello di sicurezza specializzato per rilevare attacchi di prompt injection negli agenti browser IA. Raggiunge un punteggio F1 del 90,4% su BrowseSafe-Bench, ottimizzato per la classificazione asincrona in tempo reale di contenuti HTML grezzi.

Modelli Linguistici di Sicurezza Adattati al Dominio

  • ATTACK-BERT - Modello sentence-transformer per mappare il testo di sicurezza alle tecniche MITRE ATT&CK.
  • CySecBERT - Modello BERT adattato per attività di cybersecurity e CTI tramite pre-training specifico del dominio.

Dataset

  • SafetyPrompts - Raccolta curata di prompt rilevanti per la sicurezza per valutare le proprietà di safety e security degli LLM.
  • Do-Not-Answer - Dataset di prompt a cui gli LLM responsabili non dovrebbero rispondere, per valutazione della sicurezza e red teaming.
  • JailBreakV-28K - Dataset su larga scala di 28.000 prompt di jailbreak per il benchmarking della sicurezza degli LLM.
  • CL4R1T4S - Prompt di sistema trapelati da ChatGPT, Claude, Gemini, Grok, Perplexity, Cursor, Lovable, Replit e altri strumenti IA importanti. La più grande collezione conosciuta di prompt di sistema di produzione per trasparenza e ricerca sulla superficie d'attacco.
  • LEAKHUB - Classifica delle fughe di prompt di sistema — piattaforma comunitaria per tracciare e classificare le fughe di prompt di sistema tra i prodotti IA.
  • Leaked System Prompts - Raccolta di prompt di sistema trapelati da strumenti IA commerciali — utile per comprendere l'ingegneria dei prompt nel mondo reale e le superfici d'attacco.
Scarica lo strumento
  • Agentic Radar - Scanner di sicurezza CLI open source per flussi di lavoro agentici.
  • RAPTOR - Framework autonomo di ricerca sulla sicurezza offensiva/difensiva basato su Claude Code. Combina analisi statica (Semgrep, CodeQL), analisi binaria, validazione delle vulnerabilità tramite LLM, generazione di exploit e scrittura di patch. Orchestrazione multi-modello con analisi di fattibilità basata su Z3.
  • whistleblower - Strumento di sicurezza offensiva per testare la perdita del system prompt e la scoperta delle capacità di un'applicazione AI esposta tramite API
  • promptmap - Scanner di iniezione di prompt per applicazioni LLM personalizzate
  • spikee - Simple Prompt Injection Kit for Evaluation and Exploitation
  • ps-fuzz - Rendi le tue app GenAI sicure e protette: testa e indurisci il tuo system prompt
  • EasyEdit - Modifica le verità di base di un LLM
  • llm-attacks - Attacchi universali e trasferibili su modelli linguistici allineati
  • llm-security - Nuovi modi per rompere gli LLM integrati nelle applicazioni
  • Plexiglass - Un toolkit per rilevare e proteggersi dalle vulnerabilità nei grandi modelli linguistici (LLM).
  • Risorse per il prompt hacking - Un elenco di risorse curate per chi è interessato al red teaming dell'AI, al jailbreaking e all'iniezione di prompt
  • Giskard - Valutazione e test open source per sistemi AI e LLM
  • blackice - BlackIce è un toolkit containerizzato open source progettato per il red teaming di modelli AI, inclusi grandi modelli linguistici (LLM) e modelli classici di machine learning (ML). Ispirato alla comodità e standardizzazione di Kali Linux nei penetration test tradizionali, BlackIce semplifica le valutazioni di sicurezza dell'AI fornendo un'immagine container riproducibile preconfigurata con strumenti di valutazione specializzati.
  • ai-best-practices - Regole Semgrep Pro per garantire che il codice che utilizza LLM segua le best practice. 58 regole, 102 sotto-regole che coprono 6 provider + MCP + hook Claude Code e Cursor + LangChain. Rileva chiavi API hardcoded, rischi di iniezione di prompt, controlli di sicurezza mancanti ed errori non gestiti in 7 linguaggi.
  • G0DM0D3 - Interfaccia chat multi-modello open source per il red teaming con oltre 50 modelli tramite OpenRouter. Include GODMODE CLASSIC (5 combinazioni di jailbreak), valutazione multi-modello ULTRAPLINIAN, motore di perturbazione dell'input Parseltongue con 33 tecniche di red team e campionamento adattivo AutoTune per la ricerca sulla sicurezza dell'AI.
  • L1B3RT4S - Raccolta di prompt di jailbreak e liberazione per i principali LLM. Libreria curata di prompt avversariali progettati per testare e valutare le salvaguardie di sicurezza dell'AI in ChatGPT, Claude, Gemini e altri modelli all'avanguardia.
  • OBLITERATUS - Toolkit di abliteration che rimuove i comportamenti di rifiuto dagli LLM open source senza riaddestramento. Modifica i pesi del modello per eliminare le risposte di rifiuto allineate alla sicurezza, consentendo la ricerca sul comportamento illimitato del modello.
  • T3MP3ST - Piattaforma di red teaming autonoma e meta-harness di sicurezza offensiva multi-agente. Coordina sciami di agenti AI per test avversariali coordinati dei sistemi AI all'avanguardia.
  • P4RS3LT0NGV3 - Toolkit universale di trasformazione del testo e creazione di prompt. Supporta traduzione, mutazione, codifica/decodifica e ingegneria avversariale dei prompt per la costruzione di payload di jailbreak.
  • claude-secure-coding-rules - Regole di sicurezza open source che guidano Claude Code a generare codice sicuro per impostazione predefinita.
  • DeepTeam - Framework di red teaming per LLM con oltre 40 metodi di attacco, tra cui iniezione di prompt, jailbreaking e avvelenamento RAG. Si integra con pipeline CI/CD.
  • CyberStrikeAI - Piattaforma di test di sicurezza nativa per l'IA sviluppata in Go. Integra oltre 100 strumenti di sicurezza con un motore di orchestrazione intelligente, test basati sui ruoli con ruoli di sicurezza predefiniti, un sistema di competenze e una gestione completa del ciclo di vita. Utilizza il protocollo MCP e agenti AI per l'automazione end-to-end, dai comandi conversazionali alla scoperta delle vulnerabilità.
  • HexStrikeAI - HexStrike AI MCP Agents è un server MCP avanzato che consente agli agenti AI (Claude, GPT, Copilot, ecc.) di eseguire autonomamente oltre 150 strumenti di cybersecurity per pentesting automatizzato, scoperta di vulnerabilità, automazione del bug bounty e ricerca sulla sicurezza.
  • mcp-for-security - Una raccolta di server Model Context Protocol per strumenti di sicurezza popolari come SQLMap, FFUF, NMAP, Masscan e altri. Integra i test di sicurezza e i penetration test nei flussi di lavoro AI.
  • mcp-security-hub - Una collezione in crescita di server MCP che portano strumenti di sicurezza offensiva agli assistenti AI. Nmap, Ghidra, Nuclei, SQLMap, Hashcat e altri.
  • Burp MCP Server - Server MCP per Burp
  • burpgpt - Un'estensione di Burp Suite che integra GPT di OpenAI per eseguire una scansione passiva aggiuntiva per scoprire vulnerabilità altamente personalizzate e consente di eseguire analisi basate sul traffico di qualsiasi tipo.
  • guardian-cli - Test di sicurezza e scanner di vulnerabilità potenziati dall'IA. Guardian CLI è uno strumento intelligente di test di sicurezza che sfrutta l'IA per automatizzare i penetration test, la valutazione delle vulnerabilità e l'auditing di sicurezza.
  • AutoPentestX - AutoPentestX – Strumento automatizzato di penetration testing e reportistica delle vulnerabilità per Linux
  • HackGPT - Uno strumento che utilizza ChatGPT per l'hacking
  • nano-analyzer - Un minimal scanner di vulnerabilità zero-day basato su LLM di AISLE.
  • clearwing - Scanner autonomo di vulnerabilità e cacciatore di codice sorgente costruito su LangGraph.
  • Zen-AI-Pentest - Framework di penetration testing potenziato dall'IA con scansione automatizzata delle vulnerabilità, sistema multi-agente e reportistica di conformità. Oltre 72 strumenti di sicurezza, sandbox Docker, agenti ReAct, analisi dei percorsi d'attacco.
  • Violin - Profilo di pentest Hermes Agent supervisionato e basato su agenti: 31 playbook basati su competenze (OWASP Top 10, API Top 10, LLM Top 10) con definizione interattiva dell'ambito, convalida dell'ambito e gate di approvazione per ricognizione autorizzata, convalida degli exploit e reportistica.
  • NeuroSploit - Harness di pentesting multi-modello autonomo in Rust. Il pool di LLM guida la ricognizione, la selezione degli agenti, l'incatenamento degli exploit e il voto di convalida cross-modello nelle modalità di test black-box, white-box, grey-box e cloud.
  • OpenHack - Scanner multi-agente potenziato dall'IA che trova autonomamente SQLi, XSS, IDOR e bypass di autenticazione nella tua codebase, quindi verifica ogni risultato tramite esecuzione in sandbox e replay del browser. All'altezza di Claude Opus 4.6 a un costo circa 40 volte inferiore.
  • PentAGI - Sistema multi-agente completamente autonomo per complessi compiti di penetration testing. Esecuzione in sandbox Docker, supporto LLM multi-provider (OpenAI, Anthropic, Gemini, Ollama, DeepSeek), integrazione di knowledge graph e supervisione degli agenti in tempo reale.
  • V3SP3R - Compagno di hacking hardware potenziato dall'IA per Flipper Zero. Interfaccia in linguaggio naturale per controllare attacchi hardware, con integrazione di smart glasses per funzionamento a mani libere.
  • Middleware di sicurezza per agenti AI con difesa a 8 livelli contro prompt injection, esfiltrazione di dati e comandi pericolosi. Zero dipendenze.
  • CodeGate - Un progetto open-source focalizzato sulla privacy che funge da livello di sicurezza all'interno del flusso di lavoro di generazione di codice AI dello sviluppatore
  • Future AGI - Piattaforma open-source auto-ospitabile con guardrail in tempo reale integrati per output non sicuri (jailbreak, PII, injection, tossicità), valutazioni, tracing, simulazioni e gateway per applicazioni LLM e agenti.
  • SkillSpector - Scanner di sicurezza per skill di agenti AI. Rileva 64 pattern di vulnerabilità in 16 categorie con analisi statica + valutazione semantica LLM opzionale. Output multi-formato (JSON, Markdown, SARIF).
  • Project CodeGuard - Progetto Open Source CoSAI per la sicurezza dei flussi di lavoro di sviluppo assistito dall'IA. CodeGuard fornisce controlli di sicurezza e guardrail per assistenti di codifica AI per prevenire l'introduzione di vulnerabilità durante lo sviluppo di codice generato dall'IA.
  • AgentLens - Strumenti di osservabilità e replay degli agenti per la ricerca sulla sicurezza e l'interpretabilità dell'IA. Fornitura per eseguire traiettorie di agenti multi-sessione, catturarle in formato ATIF e tracciare le modifiche allo stato dei file tra le sessioni. Costruito per studiare il comportamento degli agenti LLM in interazioni multi-turno, multi-sessione e multi-agente.
  • claude-code-devcontainer - Devcontainer sandboxato per eseguire Claude Code in modalità bypass in sicurezza. Costruito per audit di sicurezza e revisione di codice non fidato.
  • claude-code-safety-net - Un plugin per Claude Code che funge da rete di sicurezza, intercettando comandi git e filesystem distruttivi prima che vengano eseguiti
  • OneCLI - Vault di credenziali open-source per agenti AI. Il gateway HTTP in Rust intercetta le richieste degli agenti e inietta le credenziali API in modo trasparente, così gli agenti non hanno mai chiavi grezze. Crittografia AES-256-GCM, ambito per agente, registro di controllo completo.
  • OpenSandbox - Runtime sandbox sicuro, veloce ed estensibile per agenti AI. SDK multi-linguaggio, runtime Docker/Kubernetes, isolamento gVisor/Kata Containers/Firecracker. Progetto CNCF Landscape.
  • openclaw-shield - Plugin di sicurezza per agenti OpenClaw - previene fughe di segreti, esposizione di PII ed esecuzione di comandi distruttivi
  • clawsec - Scanner di sicurezza e strumento di hardening per distribuzioni OpenClaw. Fornisce valutazioni della sicurezza, audit di configurazione e rilevamento di vulnerabilità specificamente per gateway e configurazioni degli agenti OpenClaw.
  • nanoclaw - Alternativa leggera a OpenClaw che funziona in contenitori per la sicurezza. Si connette a WhatsApp, ha memoria, lavori programmati e funziona direttamente su Anthropic's Agents SDK. Primo assistente AI a supportare Agent Swarms per team di agenti collaborativi.
  • secureclaw - Hardening automatico della sicurezza per agenti AI OpenClaw di Adversa AI. 51 controlli di audit, 12 regole comportamentali, 9 script, 4 database di pattern. Copertura completa OWASP ASI Top 10. Protegge contro prompt injection, furto di credenziali, attacchi alla supply chain e fughe di privacy.
  • defenseclaw - Livello di governance aziendale per OpenClaw di Cisco AI Defense. Scansiona skill, server MCP e plugin con CodeGuard SAST integrato, motore di ispezione delle chiamate agli strumenti, proxy guardrail LLM e integrazione SIEM. Blocca automaticamente i risultati ALTI/CRITICI.
  • microsandbox - Sandbox microVM leggera per eseguire codice generato dall'IA non fidato in sicurezza con forti garanzie di isolamento
  • Adrian - Motore di monitoraggio e controllo della sicurezza runtime open-source, allineato ad AARM, per agenti AI di Secure Agentics. Analizza i log di attività degli agenti (chiamate a strumenti, azioni, output) e le tracce di ragionamento per rilevare comportamenti malevoli, disallineati o fuori ambito, con intervento in volo opzionale (modalità audit vs blocco). SDK Python (LangChain/LangGraph) e TypeScript, completamente auto-ospitabile offline. Apache-2.0.
  • HOL Guard - Fornitura di sicurezza local-first che intercetta le chiamate agli strumenti negli agenti di codifica AI (Codex, Claude Code, Cursor, Gemini, Copilot, Hermes, OpenCode) prima che i file vengano modificati o la rete venga contattata. Hook pre-strumento, centro di approvazione, scansione consultiva della supply chain e sincronizzazione opzionale con Guard Cloud.
  • GhidraGPT - Integra i modelli GPT in Ghidra per l'analisi automatica del codice, rinomina variabili, rilevamento di vulnerabilità e generazione di spiegazioni.
  • IDAssist - Plugin di reverse engineering potenziato dall'IA per IDA Pro. Integra analisi basata su LLM nell'interfaccia di IDA con grafi di conoscenza semantica, ricerca documenti RAG e supporto per molteplici provider LLM (OpenAI, Anthropic, Ollama, LiteLLM). Analizza funzioni, suggerisce rinomine, risponde a domande sul codice.
  • ThreatForest - Piattaforma di threat modeling agentica basata sul framework Strands. Genera autonomamente alberi di attacco dai repository, mappa i passaggi di attacco alle tecniche MITRE ATT&CK e produce raccomandazioni di mitigazione attuabili.
  • claude-grc-plugin - Plugin per Claude Code che trasforma Claude in un analista GRC senior. Oltre 72 file di riferimento che coprono 15 framework (NIST 800-53, FedRAMP, ISO 27001, SOC 2, ecc.), 24 comandi slash e conoscenza approfondita del dominio per il lavoro di conformità federale e commerciale.
  • Vigil SOC - Una piattaforma operativa di sicurezza open-source completa per agenti di IA, che consente monitoraggio in tempo reale, rilevamento delle minacce e risposta agli incidenti per ambienti potenziati dall'IA.
  • AiSOC - SOC open-source auto-ospitabile potenziato dall'IA che acquisisce eventi di sicurezza, li correla, esegue indagini autonome basate sull'IA tramite LangGraph e presenta i risultati in una console unificata. Include registro di audit completo delle decisioni degli agenti, harness di valutazione pubblico in CI e 52 connettori di prima parte. Licenza MIT.
  • Mantis Skills - Pipeline di competenze IA agentiche disaccoppiata, sequenziale e incentrata sulla sicurezza di Google per revisionare, deduplicare, validare, riprodurre e correggere autonomamente vulnerabilità in basi di codice di qualsiasi dimensione. Caratterizza una pipeline multi-stadio (analisi dell'architettura → threat modeling → ricerca → revisione → riproduzione → patching → calibrazione → riflessione), sandboxing integrato e un ciclo di apprendimento continuo che si adatta attraverso esecuzioni iterative. Supporta hardware RTL, IaC, pipeline ML e binari compilati.