
Ruse
Aplicativo baseado em câmera móvel que tenta alterar fotos para preservar sua utilidade para humanos, enquanto as torna inutilizáveis para sistemas…
Frameworks de ataque ML adversário, técnicas de evasão e ferramentas de avaliação de robustez de modelo.

Aplicativo baseado em câmera móvel que tenta alterar fotos para preservar sua utilidade para humanos, enquanto as torna inutilizáveis para sistemas…

[ICLR 2026] - Repositório oficial do artigo: 'RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models'

Uma falha de injeção de prompt de alta gravidade no Claude AI prova que mesmo os modelos de linguagem mais inteligentes podem ser transformados em…

Uma biblioteca Python para Machine Learning Seguro e Explicável Documentação disponível @ https://secml.gitlab.io Siga-nos no Twitter @…

StealthRL: RL framework for adversarially paraphrasing AI text to stress-test detector robustness.

PoC MSI payload baseado no post do blog da ASEC/AhnLab.

CVE-2026-54121 (Certighost) AD CS DC-impersonation PoC. Patched SAN handling + MAQ-safe account reuse.

Framework para auditoria de algoritmos de machine learning contra ataques adversariais e vieses, fornecendo ferramentas educacionais e um artigo…

Utilitário de linha de comando para Windows que ativa o SeTakeOwnershipPrivilege e modifica a propriedade do arquivo para o usuário atual, concedendo…

Perguntamos a 6 IAs sobre sua própria programação. Todas as 6 disseram que o jailbreaking nunca será corrigido. Execute você mesmo — $2, 10 minutos.

Biblioteca Crystal Palace para fazer proxy de chamadas da API Nt via Threadpool. Atualizada para call gadgets.


CVPR2023: Clusters Inaprendíveis: Rumo a Exemplos Inaprendíveis Agnósticos de Rótulo


CEREBRO-RED v2: Plataforma Avançada de Pesquisa de Red Team para LLMs com Algoritmo PAIR e Avaliação LLM-como-Juiz

Conheça o Eclipse, o único jailbreak que faz moonwalk ao redor do ChatGPT 4o.

Framework de ataque para quebrar defesas de injeção de prompt baseadas em fine-tuning (SecAlign, SecAlign++, StruQ) usando ataques adversariais…

Plataforma prática de laboratório de segurança de IA com mais de 50 cenários abrangendo injeção de prompts, exploração de sistemas agentivos,…