
StepJack
Framework de benchmark para avaliar agentes de IA de uso de computador contra injeção indireta de prompt em múltiplas etapas, com decomposição…
Frameworks de ataque ML adversário, técnicas de evasão e ferramentas de avaliação de robustez de modelo.

Framework de benchmark para avaliar agentes de IA de uso de computador contra injeção indireta de prompt em múltiplas etapas, com decomposição…

Performing Indirect Clean Syscalls

Plataforma prática de laboratório de segurança de IA com mais de 50 cenários abrangendo injeção de prompts, exploração de sistemas agentivos,…


Estrutura de simulação de adversários baseada em playbook que compila caminhos de ataque definidos em JSON em payloads de shellcode independentes de…

Código de pesquisa que implementa métodos de ataque e defesa backdoor para LLMs, incluindo os algoritmos IBSD, SLIP, BeDKD e BadApex.

Purple Team Exercise Framework

NimicStack is the pure Nim implementation of Call Stack Spoofing technique to mimic legitimate programs

Matador do Windows Defender | Desativação baseada em registro + Encerramento de processos por BYOVD (C++)

Atribuição causal de contexto e monitor baseado em regras para defesa de LLM contra injeção indireta de prompt em agentes LLM, alcançando desempenho…

A Ferramenta de Identificação de Riscos em Python para IA generativa (PyRIT) é um framework de código aberto desenvolvido para capacitar…

AGLS

CEREBRO-RED v2: Plataforma Avançada de Pesquisa de Red Team para LLMs com Algoritmo PAIR e Avaliação LLM-como-Juiz

Console de ataque de injeção de prompt de código aberto. Teste a segurança de IA disparando ataques categorizados em qualquer endpoint.

Framework de ataque para quebrar defesas de injeção de prompt baseadas em fine-tuning (SecAlign, SecAlign++, StruQ) usando ataques adversariais…

Evasão de AV/EDR via chamadas de sistema diretas e indiretas do Windows NT 3.1 ao Windows 11 24H2 · x64 · x86 · WoW64 · ARM64

[ICLR 2026] - Repositório oficial do artigo: 'RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models'

Um servidor SSL-VPN delicioso, mas malicioso 🌮