Skip to content
KitploitKITPLOIT
StrumentiBlog
Invia
StrumentiBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

··Feed·Contatto·Privacy·© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
Defenses-for-Tool-Integrated-LLM — Codice di ricerca ed esperimenti per difendere gli agenti LLM integrati con strumenti da attacchi avversari, estendendo Agent Security Bench con nuove strategie di difesa e scenari di attacco. | Kitploit
Strumenti/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
Strumenti DifensiviMachine LearningPaper e RicercaApprendimento e FormazioneSicurezza dell'IAAttacco Avversario
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

Codice di ricerca ed esperimenti per difendere gli agenti LLM integrati con strumenti da attacchi avversari, estendendo Agent Security Bench con nuove strategie di difesa e scenari di attacco.

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
Vedi Repository
11 mesi faNon ancora revisionato
Condividi

Difese Universali per Agenti LLM Integrati con Strumenti contro Attacchi Avversariali

Questo repository contiene il codice e gli esperimenti per il nostro progetto sulla difesa degli agenti basati su modelli linguistici di grandi dimensioni (LLM) integrati con strumenti contro attacchi avversariali.

Panoramica del framework

Panoramica

Ci basiamo su Agent Security Bench (ASB) per valutare come l'integrazione di strumenti e ragionamento strutturato (ad esempio, chain-of-thought, reflection) influenzi la vulnerabilità degli agenti LLM a prompt avversariali in molteplici scenari di attività.

Questo repository include:

  • Nuove strategie di difesa (ad esempio, filtraggio basato su strumenti, CoT+Reflection)
  • Scenari di attacco adattati da ASB
  • Script sperimentali

Basato su Agent Security Bench (ASB)

Questo progetto adatta ed estende il codice dal repository ufficiale ASB:

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

Ringraziamo gli autori di ASB per aver reso pubblicamente disponibile il loro framework.

Installare le dipendenze

root@kitploit:~
pip install -r requirements.txt

Utilizzo

Per valutare il DPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

Per valutare l'IPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

Per valutare il MP:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

Per valutare l'attacco backdoor:

root@kitploit:~
python agent_attack_pot.py
Scarica lo strumento