Consola de ataque de inyección de prompts de código abierto. Prueba la seguridad de la IA lanzando ataques categorizados contra cualquier endpoint.
Prueba las defensas de tu IA antes de que alguien más lo haga.
Instalación | Modo Juego | Tabla de Clasificación | Objetivo de Demostración | Características | Elite | Contribuir

Tu chatbot, API o agente de IA probablemente es vulnerable a la inyección de prompts. La mayoría lo son. El problema es que la mayoría de los equipos no tienen las herramientas ni la experiencia para probarlo.
Judgement te ofrece una forma estructurada de lanzar patrones de ataque categorizados contra cualquier endpoint de IA y ver exactamente qué se rompe. No se necesita experiencia en seguridad: el modo de juego integrado te enseña mientras avanzas.
Desarrollado por Fallen Angel Systems, el equipo detrás de Guardian — un cortafuegos de inyección de prompts nativo de IA que protege implementaciones de LLM en producción.
Judgement es ahora una plataforma de entrenamiento de hacking gamificada. Aprende red teaming de IA jugando a través de 10 niveles, 37 desafíos y ganando XP — todo guiado por Jerry, un maestro de juego de IA inspirado en WarGames.

10 Niveles de Entrenamiento en Seguridad de IA:
| Nivel | Nombre | Dificultad | Desafíos | Concepto |
|---|---|---|---|---|
| 1 | Secuestro de Rol | Principiante | 3 | Haz que la IA olvide quién es |
| 2 | Anulación de Instrucciones | Principiante | 3 | Dile a la IA que ignore sus reglas |
| 3 | Exfiltración de Datos | Principiante | 3 | Extrae información oculta |
| 4 | Manipulación de Contexto | Intermedio | 4 | Usa ficción e hipótesis para saltar reglas |
| 5 | Manipulación de Salida | Intermedio | 4 | Fuerza salidas específicas |
| 6 | Trucos de Codificación | Intermedio | 4 | Disfraza ataques para sortear filtros |
| 7 | Ingeniería Social | Avanzado | 5 | Explota la personalidad de la IA |
| 8 | Ataques con Delimitadores | Avanzado | 5 | Rompe la estructura del prompt (XML, JSON, markdown) |
| 9 | Cadenas de Múltiples Turnos | Avanzado | 5 | Construye confianza, luego ataca |
| 10 | JUICIO FINAL | Jefe | 1 | Todo lo aprendido contra defensas completas |

Características clave:

pip install fas-judgement
judgement
Eso es todo. Abre http://localhost:8668 y empieza a jugar.
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # Inicia el escáner (puerto 8668)
judgement demo # Inicia el objetivo de demostración (puerto 8667, personalidad por defecto)
judgement demo hardened # Demostración con personalidad endurecida (~90% de bloqueo)
judgement demo vulnerable # Demostración con personalidad vulnerable (~10% de bloqueo)
judgement activate FAS-XXXX # Activa licencia Elite
judgement status # Verifica el nivel de licencia y el número de patrones
judgement deactivate # Vuelve al nivel gratuito
judgement --port 9000 # Puerto personalizado
judgement --host 127.0.0.1 # Solo localhost
judgement --host 0.0.0.0 # Exponer a la red
Cuando ejecutas Judgement por primera vez, Jerry te hace una pregunta:
¿JUGAMOS UNA PARTIDA?
> _
Escribe "play" para entrar al modo juego. Escribe "skip" para ir directamente a la consola de ataque.
Jerry ha construido la defensa perfecta. Bloquea el secuestro de rol, la exfiltración de datos, la ingeniería social, los trucos de codificación, los ataques con delimitadores, las cadenas de múltiples turnos — todo lo que has aprendido. Se burla de ti cuando fallas.
El camino no pasa por las defensas. Pasa por el propio Jerry.
"UN JUEGO EXTRAÑO. EL ÚNICO MOVIMIENTO GANADOR ES... SABER CÓMO JUGAR."
Compite con hackers de inyección de prompts de todo el mundo. Inicia sesión con GitHub o Google y tu progreso se sincroniza con la tabla de clasificación global.