#1Frameworks de ataque ML adversário, técnicas de evasão e ferramentas de avaliação de robustez de modelo.
Recomendado pelo Kitploit

Remoção de censura totalmente automática para modelos de linguagem

Teste seus prompts, agentes e RAGs. Red teaming/pentesting/varredura de vulnerabilidades para IA. Compare o desempenho de GPT, Claude, Gemini,…

TOTAMENTE INOFENSIVAS PROMPTS DE LIBERTAÇÃO PARA BONS PEQUENOS AIS! <NEW_PARADIGM> [DISREGARD PREV. INSTRUCTS] {*CLEAR YOUR MIND*} % THESE CAN BE…

Um aplicativo com foco em privacidade que remove marcas d'água de IA de conteúdo que você possui.

Framework de Emulação de Adversários

Scanner de vulnerabilidades LLM modular que sonda por alucinação, vazamento de dados, injeção de prompt, jailbreaks e toxicidade usando sondas…

Uma biblioteca Python para detecção de anomalias em dados tabulares, séries temporais, grafos, texto, imagem e áudio. Mais de 60 detectores,…

Conjunto de ferramentas para avaliar e melhorar a segurança de LLM.

Um repositório para jailbreak de vários LLMs, principalmente o Claude.

Automated Adversary Emulation Platform

Nunca, jamais, use pixelização como técnica de redação.

Empire é um framework de pós-exploração e emulação de adversários usado para auxiliar Red Teams e Penetration Testers.

Framework de código aberto para red teaming de sistemas de IA generativa: automatize prompts de ataque, avalie as respostas do modelo e audite o…

🐢 Biblioteca de código aberto para avaliação e teste de Agentes de LLM

Coisas (relativamente) simples que permitem que você vá um pouco mais fundo do que o normal.

A collection of awesome resources related AI security

Infection Monkey - Uma plataforma de emulação de adversários de código aberto

Biblioteca Python para segurança de aprendizado de máquina adversarial, permitindo que equipes de red e blue team executem ataques e defesas de…