Skip to content
KitploitKITPLOIT
StrumentiBlog
Invia
StrumentiBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

··Feed·Contatto·Privacy·© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — Un nuovo attacco avversario sui LLM basato sulla tecnica dell'Exponentiated Gradient Descent. | Kitploit
Strumenti/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
Machine LearningPaper e RicercaSicurezza dell'IAAttacco Avversario
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

Un nuovo attacco avversario sui LLM basato sulla tecnica dell'Exponentiated Gradient Descent.

Vedi Repository

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
Condividi
418 mesi faNon ancora revisionato

Modifica il file Readme.

Questo è un progetto che esplora il metodo di ottimizzazione Exponentiated Gradient Descent per produrre suffissi avversari con cui attaccare modelli linguistici di grandi dimensioni allineati. Il metodo si è dimostrato efficace sul modello chat Llama-2 con 7 miliardi di parametri.

Per eseguire lo script pgd su un certo numero di comportamenti (ad esempio, 20), esegui il seguente comando nella shell. python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

Il prossimo obiettivo è costruire una pipeline simile per EGD con lo script di ottimizzazione Adam.

Scarica lo strumento