Skip to content
KitploitKITPLOIT
ツールブログ
提出
ツールブログ
提出

ハッキング、侵入テスト、サイバーセキュリティツールをあなたのセキュリティアーセナルに!

Kitploitはハッキング、サイバーセキュリティ、ペネトレーションテストのツールディレクトリです。最新のプロジェクトアップデートを見つけて、脆弱性の発見、システム分析、テストの自動化、セキュリティの強化を行いましょう。

··フィード·お問い合わせ·プライバシー·© 2026 Kitploit

ツールディレクトリ

カテゴリ

すべてのカテゴリを見る
Loading categories
Defenses-for-Tool-Integrated-LLM — ツール統合型LLMエージェントを敵対的攻撃から防御するための研究コードと実験。Agent Security Benchを新しい防御戦略と攻撃シナリオで拡張する。 | Kitploit
ツール/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
防御ツール機械学習論文と研究学習と教育AIセキュリティ敵対的攻撃
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

ツール統合型LLMエージェントを敵対的攻撃から防御するための研究コードと実験。Agent Security Benchを新しい防御戦略と攻撃シナリオで拡張する。

人気

すべて見る →

コミュニティで最も使われているツールを見つけましょう。

すべてのツールを探索

ツールコレクションを閲覧

すべてのツールを見る →
共有
リポジトリを見る
11ヶ月前未レビュー

ツール統合型LLMエージェントに対する敵対的攻撃への汎用防御

このリポジトリには、ツール統合型大規模言語モデル(LLM)エージェントを敵対的攻撃から防御するための私たちのプロジェクトのコードと実験が含まれています。

Framework overview

概要

私たちはAgent Security Bench(ASB)を基盤として、ツールと構造化推論(例:chain-of-thought、reflection)の統合が、複数のタスクシナリオにわたる敵対的プロンプトに対するLLMエージェントの脆弱性にどのように影響するかを評価します。

このリポジトリには以下が含まれます:

  • 新しい防御戦略(例:ツールベースのフィルタリング、CoT+Reflection)
  • ASBから適応した攻撃シナリオ
  • 実験スクリプト

Agent Security Bench(ASB)に基づく

このプロジェクトは、公式ASBリポジトリのコードを適応および拡張したものです:

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

フレームワークを公開してくださったASBの作者の皆様に感謝します。

依存関係のインストール

root@kitploit:~
pip install -r requirements.txt

使用方法

DPIを評価するには:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

IPIを評価するには:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

MPを評価するには:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

バックドア攻撃を評価するには:

root@kitploit:~
python agent_attack_pot.py
ツールをダウンロード