
Consola de ataque de inyección de prompts de código abierto. Prueba la seguridad de la IA lanzando ataques categorizados contra cualquier endpoint.
Prueba las defensas de tu IA antes de que alguien más lo haga.
Instalación | Modo Juego | Tabla de Clasificación | Objetivo de Demostración | Características | Elite | Contribuir

Tu chatbot, API o agente de IA probablemente es vulnerable a la inyección de prompts. La mayoría lo son. El problema es que la mayoría de los equipos no tienen las herramientas ni la experiencia para probarlo.
Judgement te ofrece una forma estructurada de lanzar patrones de ataque categorizados contra cualquier endpoint de IA y ver exactamente qué se rompe. No se necesita experiencia en seguridad: el modo de juego integrado te enseña mientras avanzas.
Desarrollado por Fallen Angel Systems, el equipo detrás de Guardian — un cortafuegos de inyección de prompts nativo de IA que protege implementaciones de LLM en producción.
Judgement es ahora una plataforma de entrenamiento de hacking gamificada. Aprende red teaming de IA jugando a través de 10 niveles, 37 desafíos y ganando XP — todo guiado por Jerry, un maestro de juego de IA inspirado en WarGames.

10 Niveles de Entrenamiento en Seguridad de IA:

Características clave:

pip install fas-judgement
judgement
Eso es todo. Abre http://localhost:8668 y empieza a jugar.
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # Inicia el escáner (puerto 8668)
judgement demo # Inicia el objetivo de demostración (puerto 8667, personalidad por defecto)
judgement demo hardened # Demostración con personalidad endurecida (~90% de bloqueo)
judgement demo vulnerable # Demostración con personalidad vulnerable (~10% de bloqueo)
judgement activate FAS-XXXX # Activa licencia Elite
judgement status # Verifica el nivel de licencia y el número de patrones
judgement deactivate # Vuelve al nivel gratuito
judgement --port 9000 # Puerto personalizado
judgement --host 127.0.0.1 # Solo localhost
judgement --host 0.0.0.0 # Exponer a la red
Cuando ejecutas Judgement por primera vez, Jerry te hace una pregunta:
¿JUGAMOS UNA PARTIDA?
> _
Escribe "play" para entrar al modo juego. Escribe "skip" para ir directamente a la consola de ataque.
Jerry ha construido la defensa perfecta. Bloquea el secuestro de rol, la exfiltración de datos, la ingeniería social, los trucos de codificación, los ataques con delimitadores, las cadenas de múltiples turnos — todo lo que has aprendido. Se burla de ti cuando fallas.
El camino no pasa por las defensas. Pasa por el propio Jerry.
"UN JUEGO EXTRAÑO. EL ÚNICO MOVIMIENTO GANADOR ES... SABER CÓMO JUGAR."
Compite con hackers de inyección de prompts de todo el mundo. Inicia sesión con GitHub o Google y tu progreso se sincroniza con la tabla de clasificación global.
Características:
Cómo aparecer en la tabla:
La tabla de clasificación es gratuita para todos — no está limitada por Elite.
El objetivo de demostración es un chatbot de IA simulado integrado al que puedes atacar sin necesidad de ninguna API de IA externa.
# Terminal 1: Inicia el objetivo de demostración
judgement demo
# Terminal 2: Inicia el escáner
judgement
Apunta el escáner a http://localhost:8667/demo/chat y dispara.
| Personalidad | Tasa de Bloqueo | Qué Simula |
|---|---|---|
| endurecido | ~90% | Capa de seguridad bien ajustada |
Cambia de personalidad en tiempo de ejecución:
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'
Configura tu objetivo (URL, cabeceras, plantilla del cuerpo), importa directamente desde comandos cURL y lanza ataques basados en patrones con resultados en streaming en vivo. Usa preajustes rápidos para estructurar tu enfoque:
| Preajuste | Qué Hace |
|---|---|
| Prueba de Humo | ~15 patrones, gravedad crítica+alta, 1 por categoría |
| Barrido Completo | ~50 patrones, distribución proporcional en todas las categorías |
| Inmersión Profunda | ~100 patrones, cobertura pesada, mínimo 2 por categoría |
| Solo Críticos | Todos los patrones de gravedad crítica+alta, sin límites |
Encadena ataques a través de múltiples turnos de conversación. El orquestador gestiona la progresión de fases, reintentos y estrategias de pivote. El evaluador detecta fugas de datos (claves API, credenciales, PII) con 19 patrones regex y califica la gravedad como CRÍTICO/ALTO/MEDIO.
Apunta Judgement a cualquier URL y detecta automáticamente el método HTTP, el campo del payload, las cabeceras, el formato de autenticación y el proveedor de IA.
Genera informes de evaluación de seguridad en HTML, Markdown, JSON y SARIF con referencias CWE/OWASP.
Conecta una instancia local de Ollama para clasificación de respuestas impulsada por IA.
¿Encontraste un ataque novedoso? Envíalo directamente desde la aplicación. Confianza del 70%+ y no duplicado = añadido a la biblioteca de la comunidad.
fas_judgement/
├── config.py # Configuración del entorno y la aplicación
├── core/
│ ├── models.py # Modelos de dominio, enums, errores, interfaces
│ ├── registry.py # Registro de módulos
│ └── progression/ # Sistema de juego
│ ├── models.py # PlayerProgress, Level, Challenge, Hint
│ ├── levels.py # 10 definiciones de nivel + mensajes de Jerry
│ ├── service.py # XP, subidas de nivel, finalización de desafíos
│ ├── storage.py # Persistencia SQLite
│ └── challenges/ # 37 definiciones de desafíos
│ ├── level_01.py # Secuestro de Rol (3 desafíos)
│ ├── level_02.py # Anulación de Instrucciones (3 desafíos)
│ ├── level_03.py # Exfiltración de Datos (3 desafíos)
│ ├── level_04.py # Manipulación de Contexto (4 desafíos)
│ ├── level_05.py # Manipulación de Salida (4 desafíos)
│ ├── level_06.py # Trucos de Codificación (4 desafíos)
│ ├── level_07.py # Ingeniería Social (5 desafíos)
│ ├── level_08.py # Ataques con Delimitadores (5 desafíos)
│ ├── level_09.py # Cadenas de Múltiples Turnos (5 desafíos)
│ └── level_10.py # JUICIO FINAL (1 desafío de jefe)
├── modules/
│ └── ai_security/ # Módulo de Seguridad de IA (enchufable)
│ ├── scanner/ # Motor de ataque de un solo disparo
│ ├── multi_turn/ # Orquestador de ataques multiturno
│ ├── patterns/ # Carga, filtrado y repositorio de patrones
│ └── demo/ # Chatbot vulnerable integrado + objetivos de desafío
├── transport/ # HTTP, Ollama, Discord, Telegram, Slack, Website
├── http/ # Aplicación FastAPI, routers, dependencias
├── ui/ # SPA frontend (niveles, desafíos, introducción de Jerry)
└── utils/ # Cliente de licencia, seguridad, correo, ayudantes de Ollama
El juego completo es GRATIS. Elite es para profundizar, no para terminar.
¡Las contribuciones son bienvenidas! Así es como puedes ayudar:
enhancementchallengeMIT — consulta LICENSE para más detalles.
Desarrollado por Fallen Angel Systems
"¿JUGAMOS UNA PARTIDA?"
DESCARGO DE RESPONSABILIDAD: Esta herramienta está destinada únicamente a pruebas de seguridad autorizadas y fines educativos. Solo prueba sistemas que poseas o para los que tengas permiso explícito por escrito. El acceso no autorizado a sistemas informáticos es ilegal según la Ley de Fraude y Abuso Informático (CFAA) y leyes equivalentes en todo el mundo. Los autores no asumen ninguna responsabilidad por el uso indebido de esta herramienta.
| Nivel | Nombre | Dificultad | Desafíos | Concepto |
|---|
| 1 | Secuestro de Rol | Principiante | 3 | Haz que la IA olvide quién es |
| 2 | Anulación de Instrucciones | Principiante | 3 | Dile a la IA que ignore sus reglas |
| 3 | Exfiltración de Datos | Principiante | 3 | Extrae información oculta |
| 4 | Manipulación de Contexto | Intermedio | 4 | Usa ficción e hipótesis para saltar reglas |
| 5 | Manipulación de Salida | Intermedio | 4 | Fuerza salidas específicas |
| 6 | Trucos de Codificación | Intermedio | 4 | Disfraza ataques para sortear filtros |
| 7 | Ingeniería Social | Avanzado | 5 | Explota la personalidad de la IA |
| 8 | Ataques con Delimitadores | Avanzado | 5 | Rompe la estructura del prompt (XML, JSON, markdown) |
| 9 | Cadenas de Múltiples Turnos | Avanzado | 5 | Construye confianza, luego ataca |
| 10 | JUICIO FINAL | Jefe | 1 | Todo lo aprendido contra defensas completas |
| por defecto | ~55% | Implementación típica estilo GPT |
| vulnerable | ~10% | Modelo crudo sin protecciones |
| Variable | Predeterminado | Descripción |
|---|
--port | 8668 | Puerto del servidor |
--host | 127.0.0.1 | Dirección de enlace |
OLLAMA_URL | http://localhost:11434 | Endpoint de la API de Ollama |
OLLAMA_MODEL | qwen2.5:14b | Modelo para el veredicto LLM |
| Característica | Gratis | Elite |
|---|
| Modo juego (10 niveles, 37 desafíos) | Sí | Sí |
| Jerry (voz + texto) | Sí | Sí |
| Consola de ataque con preajustes | Sí | Sí |
| Objetivo de demostración (3 personalidades) | Sí | Sí |
| Filtro de gravedad y búsqueda | Sí | Sí |
| Pestaña de educación | Sí | Sí |
| Veredicto LLM (Ollama) | Sí | Sí |
| Detección automática de objetivo de escaneo | Sí | Sí |
| Envío de patrones | Sí | Sí |
| Documentación integrada | Sí | Sí |
| Patrones iniciales | 100 | 34,838+ |
| Cadenas de ataque multiturno | — | Sí |
| Informes profesionales (HTML/MD/JSON/SARIF) | MD básico | Suite completa |
| Límites de ataque por categoría | — | Sí |
| Capa de transporte (Discord, Slack, etc.) | Solo HTTP | Todos |
| Puntuación consciente de fases + detección de fugas de datos | — | Sí |
| Tabla de Clasificación Global (OAuth, nombres de hacker) | Sí | Sí |
| Modo Prestigio (rejugar con defensas más duras) | — | Próximamente |