Skip to content
KitploitKITPLOIT
工具博客
提交
工具博客
提交

黑客、渗透测试和网络安全工具,武装您的安全武器库!

Kitploit 是一个黑客、网络安全和渗透测试工具的目录。发现最新的项目更新,查找漏洞、分析系统、自动化测试并加强你的安全。

··订阅源·联系·隐私·© 2026 Kitploit

工具目录

分类

查看所有分类
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — 一种基于指数梯度下降技术的新型LLM对抗攻击。 | Kitploit
工具/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
机器学习论文与研究AI 安全对抗性攻击
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

一种基于指数梯度下降技术的新型LLM对抗攻击。

查看仓库

最受欢迎

查看全部 →

发现我们社区最常用的工具。

探索所有工具

浏览我们的工具集合

查看所有工具 →
分享
418个月前尚未审核

更改自述文件。

这是一个探索指数梯度下降(Exponentiated Gradient Descent)优化方法来生成对抗性后缀,以攻击对齐的大型语言模型的项目。 该方法已被证明对具有 70 亿参数的 Llama-2 聊天模型有效。

要在多个行为(例如 20 个)上运行 pgd 脚本,请在 shell 中执行以下命令。 python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

下一个目标是为带有 Adam 优化脚本的 EGD 构建类似的流程。

下载工具