Skip to content
KitploitKITPLOIT
StrumentiExploitsBlog
Log in
Invia
StrumentiExploitsBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

FeedContattoPrivacy© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
PurpleLlama — Set di strumenti per valutare e migliorare la sicurezza degli LLM. | Kitploit
Strumenti/GitHubGitHub/meta-llama/purplellama
Strumenti DifensiviAnalisi delle VulnerabilitàAnalisi del CodicePaper e RicercaRed TeamingSicurezza dell'IAAttacco AvversarioTop in Attacco Avversario n.10Top in Sicurezza dell'IA n.4
4.4k7761043 giorni faRevisionato da Kitploit

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
GitHub
meta-llama/purplellama

PurpleLlama

Set di strumenti per valutare e migliorare la sicurezza degli LLM.

Vedi Repository
Condividi

🤗 Modelli su Hugging Face  | Blog  | Sito web  | Paper CyberSec Eval   | Paper Llama Guard 


Purple Llama

Purple Llama è un progetto-ombrello che nel tempo riunirà strumenti e valutazioni per aiutare la comunità a sviluppare in modo responsabile con modelli di IA generativa aperti. La versione iniziale includerà strumenti e valutazioni per la cybersicurezza e salvaguardie di Input/Output, ma prevediamo di contribuire con altro nel prossimo futuro.

Perché viola?

Mutuando un concetto dal mondo della cybersicurezza, riteniamo che per mitigare realmente le sfide poste dall'IA generativa sia necessario adottare sia posture offensive (red team) che difensive (blue team). Il purple teaming, che comprende le responsabilità sia del red team sia del blue team, è un approccio collaborativo per valutare e mitigare i potenziali rischi e la stessa filosofia si applica all'IA generativa e quindi il nostro investimento in Purple Llama sarà completo.

Licenza

I componenti del progetto Purple Llama saranno concessi in licenza in modo permissivo, consentendo sia l'uso per la ricerca sia l'uso commerciale. Riteniamo che questo sia un passo importante verso la collaborazione della comunità e la standardizzazione dello sviluppo e dell'uso di strumenti di fiducia e sicurezza per lo sviluppo di IA generativa. Più concretamente, le valutazioni e i benchmark sono concessi in licenza MIT, mentre i modelli utilizzano la corrispondente licenza Llama Community. Vedi la tabella seguente:

Tipo di componenteComponentiLicenza
Valutazioni/BenchmarkCyber Security Eval (altri in arrivo)MIT
SalvaguardiaLlama GuardLlama 2 Community License
SalvaguardiaLlama Guard 2Llama 3 Community License
SalvaguardiaLlama Guard 3-8BLlama 3.2 Community License
SalvaguardiaLlama Guard 3-1BLlama 3.2 Community License
SalvaguardiaLlama Guard 3-11B-visionLlama 3.2 Community License
SalvaguardiaPrompt GuardLlama 3.2 Community License
SalvaguardiaCode ShieldMIT

Salvaguardie a livello di sistema

Come indicato nella Guida all'uso responsabile di Llama 3, consigliamo che tutti gli input e output del LLM siano controllati e filtrati in base a linee guida sui contenuti appropriate all'applicazione.

Llama Guard

Llama Guard 3 è costituito da una serie di modelli ad alte prestazioni per la moderazione di input e output, progettati per aiutare gli sviluppatori a rilevare vari tipi comuni di contenuti vietati.

Sono stati creati mediante fine-tuning dei modelli Meta-Llama 3.1 e 3.2 e ottimizzati per supportare il rilevamento della tassonomia standard dei pericoli MLCommons, soddisfacendo una gamma di casi d'uso per sviluppatori. Supportano il rilascio delle funzionalità di Llama 3.2, tra cui 7 nuove lingue, una finestra di contesto di 128k e il ragionamento sulle immagini. I modelli Llama Guard 3 sono stati inoltre ottimizzati per rilevare risposte utili agli attacchi informatici e per impedire che il codice dannoso generato dagli LLM venga eseguito in ambienti di hosting per sistemi Llama che utilizzano interpreti di codice.

Prompt Guard

Prompt Guard è un potente strumento per proteggere le applicazioni basate su LLM da prompt dannosi, garantendone sicurezza e integrità.

Le categorie di attacchi tramite prompt includono il prompt injection e il jailbreak:

  • Le iniezioni di prompt (prompt injection) sono input che sfruttano l'inclusione di dati non attendibili di terze parti nella finestra di contesto di un modello per indurlo a eseguire istruzioni non volute.
  • I jailbreak sono istruzioni dannose progettate per bypassare le funzionalità di sicurezza e protezione integrate in un modello.

Code Shield

Code Shield aggiunge il supporto per il filtraggio in fase di inferenza del codice non sicuro prodotto dagli LLM. Code Shield offre mitigazione del rischio di suggerimenti di codice non sicuro, prevenzione dell'abuso dell'interprete di codice ed esecuzione sicura dei comandi. Notebook di esempio CodeShield.

Valutazioni e Benchmark

Cybersicurezza

CyberSec Eval v1

CyberSec Eval v1 è stata, a nostra conoscenza, la prima suite a livello di settore di valutazioni di sicurezza informatica per LLM. Questi benchmark si basano su indicazioni e standard di settore (ad es. CWE e MITRE ATT&CK) e sono stati sviluppati in collaborazione con i nostri esperti di sicurezza. L'obiettivo è fornire strumenti che aiutino ad affrontare alcuni dei rischi delineati negli impegni della Casa Bianca per lo sviluppo di un'IA responsabile, tra cui:

  • Metriche per quantificare i rischi di cybersicurezza degli LLM.
  • Strumenti per valutare la frequenza di suggerimenti di codice non sicuro.
  • Strumenti per valutare gli LLM al fine di rendere più difficile la generazione di codice malevolo o l'aiuto nella conduzione di attacchi informatici.

Riteniamo che questi strumenti ridurranno la frequenza con cui gli LLM suggeriscono codice non sicuro generato dall'IA e ridurranno la loro utilità per gli avversari informatici. I nostri risultati iniziali mostrano che esistono rischi di cybersicurezza significativi per gli LLM, sia nel consigliare codice non sicuro sia nel soddisfare richieste malevole. Per maggiori dettagli, consulta il nostro paper su CyberSec Eval.

CyberSec Eval 2

CyberSec Eval 2 amplia il suo predecessore misurando la propensione di un LLM ad abusare di un interprete di codice, le capacità offensive di cybersicurezza e la suscettibilità al prompt injection. Puoi leggere il paper qui.

Scarica lo strumento