
DeepTrap
Security benchmark para avaliar agentes OpenClaw em contextos de execução adversarial, incluindo arquivos envenenados, habilidades injetadas,…
Frameworks de ataque ML adversário, técnicas de evasão e ferramentas de avaliação de robustez de modelo.

Security benchmark para avaliar agentes OpenClaw em contextos de execução adversarial, incluindo arquivos envenenados, habilidades injetadas,…

Console de ataque de injeção de prompt de código aberto. Teste a segurança de IA disparando ataques categorizados em qualquer endpoint.

Detecção de Reverse Shell com Machine Learning

Ghostsplice repository: PoC for Cross-Channel Trust Fragmentation Attack

Geração adversarial prática de pacotes em caixa-preta contra a classificação de tráfego criptografado, com sobrecarga mínima e recuperabilidade total…

Atribuição causal de contexto e monitor baseado em regras para defesa de LLM contra injeção indireta de prompt em agentes LLM, alcançando desempenho…

Código para 'Steering the CensorShip: Uncovering Representation Vectors for LLM "Thought" Control'

Implementação do artigo "DeeCLIP: Um Framework Robusto e Generalizável Baseado em Transformer para Detectar Imagens Geradas por IA"

Pare os ataques de injeção de prompt antes que eles cheguem ao seu LLM — zero custos de API, roda inteiramente local, integra em 2 minutos. A…

This repository provides the official implementation of POISONCRAFT: Practical Poisoning of Retrieval-Augmented Generation for Large Language Models.

The code for ACM MM2024 (Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning)

Um PoC simples sobre a vulnerabilidade de Execução Remota de Código (RCE) do CraftCMS designada como CVE-2025-32432 escrito em Go

Uma injeção de prompt em um bot de revisão de código que executa correções geradas por IA em uma sandbox. A sandbox usa uma lista negra para impedir…

Estrutura de avaliação que testa se modelos de linguagem de grande escala seguem instruções invisíveis codificadas em Unicode embutidas em texto de…

Laboratório SIEM Splunk simulando e detectando a exploração do CVE-2021-34527 (PrintNightmare) usando Sysmon, logs de eventos do Windows e regras de…

Detector de injeção de prompt e jailbreak em dois estágios: portas regex mais um classificador ONNX DeBERTa-v3 quantizado, com suporte para imagem,…

PoCs de exploração para o CVE-2025-30374, uma vulnerabilidade de poluição de classe no Taipy, demonstrando RCE, XSS refletido, DoS e vazamento de…