Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — Um novo ataque adversarial em LLM baseado na técnica de Exponentiated Gradient Descent. | Kitploit
Ferramentas/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
Aprendizado de MáquinaPapers e PesquisaSegurança de IAAtaque Adversário
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

Um novo ataque adversarial em LLM baseado na técnica de Exponentiated Gradient Descent.

Ver Repositório

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar
41há 8 mesesAinda não revisado

Alterar arquivo Readme.

Este é um projeto que explora o método de otimização Exponentiated Gradient Descent para produzir sufixos adversariais para atacar modelos de linguagem de grande porte alinhados. O método se mostra eficaz no modelo de chat Llama-2 com 7 bilhões de parâmetros.

Para executar o script pgd em um número de comportamentos (ou seja, 20), execute o seguinte comando no shell. python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

O próximo objetivo é construir um pipeline semelhante para o EGD com o script de otimização Adam.

Baixar ferramenta