
arp-dns-spoof
Código de exemplo para spoofing de DNS com envenenamento de ARP.
Frameworks de ataque ML adversário, técnicas de evasão e ferramentas de avaliação de robustez de modelo.

Código de exemplo para spoofing de DNS com envenenamento de ARP.

Perguntamos a 6 IAs sobre sua própria programação. Todas as 6 disseram que o jailbreaking nunca será corrigido. Execute você mesmo — $2, 10 minutos.

StealthRL: RL framework for adversarially paraphrasing AI text to stress-test detector robustness.

Plataforma de segurança de IA de código aberto que fornece defesa perimetral para LLMs e agentes de IA por meio de análise de enxame, imposição de…

CEREBRO-RED v2: Plataforma Avançada de Pesquisa de Red Team para LLMs com Algoritmo PAIR e Avaliação LLM-como-Juiz

The code for ACM MM2024 (Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning)

Implementação do artigo "DeeCLIP: Um Framework Robusto e Generalizável Baseado em Transformer para Detectar Imagens Geradas por IA"

Console de ataque de injeção de prompt de código aberto. Teste a segurança de IA disparando ataques categorizados em qualquer endpoint.

Código para 'Steering the CensorShip: Uncovering Representation Vectors for LLM "Thought" Control'

Framework de ataque para quebrar defesas de injeção de prompt baseadas em fine-tuning (SecAlign, SecAlign++, StruQ) usando ataques adversariais…

This repository provides the official implementation of POISONCRAFT: Practical Poisoning of Retrieval-Augmented Generation for Large Language Models.

Plataforma prática de laboratório de segurança de IA com mais de 50 cenários abrangendo injeção de prompts, exploração de sistemas agentivos,…

Conheça o Eclipse, o único jailbreak que faz moonwalk ao redor do ChatGPT 4o.

CVE-2026-54121 (Certighost) AD CS DC-impersonation PoC. Patched SAN handling + MAQ-safe account reuse.

Security benchmark para avaliar agentes OpenClaw em contextos de execução adversarial, incluindo arquivos envenenados, habilidades injetadas,…

Atribuição causal de contexto e monitor baseado em regras para defesa de LLM contra injeção indireta de prompt em agentes LLM, alcançando desempenho…

Estrutura de avaliação que testa se modelos de linguagem de grande escala seguem instruções invisíveis codificadas em Unicode embutidas em texto de…