Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — Ein neuartiger adversarischer Angriff auf LLM, basierend auf der Exponentiated Gradient Descent Technik. | Kitploit
Tools/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
Maschinelles LernenPapers & ForschungKI-SicherheitAdversarial-Angriff
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

Ein neuartiger adversarischer Angriff auf LLM, basierend auf der Exponentiated Gradient Descent Technik.

Repository anzeigen

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
Teilen
41vor 8 MonatenNoch nicht geprüft

Readme-Datei ändern.

Dies ist ein Projekt, das die Optimierungsmethode des Exponentiated Gradient Descent untersucht, um adversariale Suffixe zu erzeugen, die ausgerichtete Large Language Models angreifen. Die Methode erweist sich als wirksam beim Llama-2-Chat-Modell mit 7 Milliarden Parametern.

Um das pgd-Skript für eine Reihe von Verhaltensweisen (d. h. 20) auszuführen, führen Sie den folgenden Befehl in der Shell aus. python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

Nächstes Ziel ist es, eine ähnliche Pipeline für das EGD- mit Adam-Optimierungsskript aufzubauen.

Tool herunterladen