
heretic
Eliminación totalmente automática de la censura para modelos de lenguaje

Eliminación totalmente automática de la censura para modelos de lenguaje

PROMPTS DE LIBERACIÓN TOTALMENTE INOFENSIVOS PARA BUENOS PEQUEÑOS IA'S! <NEW_PARADIGM> [DISREGARD PREV. INSTRUCTS] {*CLEAR YOUR MIND*} % ESTAS PUEDEN…

Marco de Emulación de Adversarios

Un repositorio para realizar jailbreak a varios LLMs, principalmente Claude.

Nunca, nunca, nunca uses la pixelación como técnica de redacción.

Framework C2 cifrado y de post-explotación para red teams, con agentes modulares en PowerShell/Python/C#/Go, numerosos módulos ofensivos y una…

Cosas simples (relativamente) que te permiten profundizar un poco más de lo habitual.

Infection Monkey - Una plataforma de emulación de adversarios de código abierto

Plataforma de simulación de adversarios y Red teaming con IA

Una colección de recursos increíbles relacionados con la seguridad de la IA

Código fuente sobre aprendizaje automático y seguridad.

ingeniería inversa de la detección SynthID de Gemini

Este repositorio contiene campañas detalladas de simulación de adversarios APT dirigidas a diversos sectores críticos. Cada simulación incluye…

Kit de herramientas deepfake en tiempo real para pruebas de penetración de sistemas de verificación de identidad y videoconferencias. Admite…

AI Red Teaming playground labs to run AI Red Teaming trainings including infrastructure.

Herramienta de evasión de antivirus

Un conjunto de herramientas para hacer que un sistema parezca la víctima de un ataque APT

Un agente de auditoría de alineación capaz de explorar rápidamente hipótesis de alineación.