Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
Defenses-for-Tool-Integrated-LLM — Pesquisa de código e experimentos para defender agentes LLM integrados a ferramentas contra ataques adversariais, ampliando o Agent Security Bench com novas estratégias de defesa e cenários de ataque. | Kitploit
Ferramentas/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
Ferramentas DefensivasAprendizado de MáquinaPapers e PesquisaAprendizado e EducaçãoSegurança de IAAtaque Adversário
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

Pesquisa de código e experimentos para defender agentes LLM integrados a ferramentas contra ataques adversariais, ampliando o Agent Security Bench com novas estratégias de defesa e cenários de ataque.

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Ver Repositório
há 11 mesesAinda não revisado
Compartilhar

Defesas Universais para Agentes LLM Integrados com Ferramentas Contra Ataques Adversariais

Este repositório contém o código e os experimentos do nosso projeto sobre a defesa de agentes de modelos de linguagem de grande porte (LLM) integrados com ferramentas contra ataques adversariais.

Visão geral do framework

Visão Geral

Baseamo-nos no Agent Security Bench (ASB) para avaliar como a integração de ferramentas e raciocínio estruturado (por exemplo, cadeia de pensamento, reflexão) afeta a vulnerabilidade de agentes LLM a prompts adversariais em múltiplos cenários de tarefas.

Este repositório inclui:

  • Novas estratégias de defesa (por exemplo, filtragem baseada em ferramentas, CoT+Reflection)
  • Cenários de ataque adaptados do ASB
  • Scripts experimentais

Baseado no Agent Security Bench (ASB)

Este projeto adapta e estende o código do repositório oficial do ASB:

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

Agradecemos aos autores do ASB por disponibilizarem publicamente o seu framework.

Instalar dependências

root@kitploit:~
pip install -r requirements.txt

Utilização

Para avaliar o DPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

Para avaliar o IPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

Para avaliar o MP:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

Para avaliar o ataque backdoor:

root@kitploit:~
python agent_attack_pot.py
Baixar ferramenta