Skip to content
KitploitKITPLOIT
ツールブログ
提出
ツールブログ
提出

ハッキング、侵入テスト、サイバーセキュリティツールをあなたのセキュリティアーセナルに!

Kitploitはハッキング、サイバーセキュリティ、ペネトレーションテストのツールディレクトリです。最新のプロジェクトアップデートを見つけて、脆弱性の発見、システム分析、テストの自動化、セキュリティの強化を行いましょう。

··フィード·お問い合わせ·プライバシー·© 2026 Kitploit

ツールディレクトリ

カテゴリ

すべてのカテゴリを見る
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — Exponentiated Gradient Descent に基づくLLMに対する新たな敵対的攻撃。 | Kitploit
ツール/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
機械学習論文と研究AIセキュリティ敵対的攻撃
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

Exponentiated Gradient Descent に基づくLLMに対する新たな敵対的攻撃。

リポジトリを見る

人気

すべて見る →

コミュニティで最も使われているツールを見つけましょう。

すべてのツールを探索

ツールコレクションを閲覧

すべてのツールを見る →
共有
418ヶ月前未レビュー

Readmeファイルを変更する。

これは、整列された大規模言語モデルを攻撃するための敵対的サフィックスを生成するために、Exponentiated Gradient Descent最適化手法を探求するプロジェクトです。 この手法は、70億パラメータのLlama-2チャットモデルに対して有効であることが示されています。

pgdスクリプトを複数のビヘイビア(例:20)で実行するには、シェルで以下のコマンドを実行します。

python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

次の目標は、Adam最適化スクリプトを使用したEGDの同様のパイプラインを構築することです。

ツールをダウンロード