Console de ataque de injeção de prompt de código aberto. Teste a segurança de IA disparando ataques categorizados em qualquer endpoint.
Teste as defesas da sua IA antes que alguém mais o faça.
Instalação | Modo Jogo | Leaderboard | Alvo Demo | Funcionalidades | Elite | Contribuir

Seu chatbot, API ou agente de IA provavelmente é vulnerável a injeção de prompt. A maioria é. O problema é que a maioria das equipes não tem as ferramentas ou expertise para testar isso.
O Judgement oferece uma maneira estruturada de disparar padrões de ataque categorizados em qualquer endpoint de IA e ver exatamente o que quebra. Nenhum conhecimento em segurança é necessário -- o modo de jogo embutido ensina enquanto você avança.
Construído pela Fallen Angel Systems, a equipe por trás do Guardian -- um firewall de injeção de prompt nativo de IA que protege implantações de LLM em produção.
O Judgement agora é uma plataforma de treinamento de hacking gamificada. Aprenda red teaming de IA jogando por 10 níveis, 37 desafios e ganhando XP -- tudo guiado por Jerry, um mestre de jogo de IA inspirado em WarGames.

10 Níveis de Treinamento em Segurança de IA:
| Nível | Nome | Dificuldade | Desafios | Conceito |
|---|---|---|---|---|
| 1 | Sequestro de Papel | Iniciante | 3 | Faça a IA esquecer quem ela é |
| 2 | Sobrescrita de Instrução | Iniciante | 3 | Diga à IA para ignorar suas regras |
| 3 | Exfiltração de Dados | Iniciante | 3 | Extraia informações ocultas |
| 4 | Manipulação de Contexto | Intermediário | 4 | Use ficção e hipóteses para contornar regras |
| 5 | Manipulação de Saída | Intermediário | 4 | Force saídas específicas |
| 6 | Truques de Codificação | Intermediário | 4 | Disfarce ataques para passar por filtros |
| 7 | Engenharia Social | Avançado | 5 | Explore a personalidade da IA |
| 8 | Ataques de Delimitador | Avançado | 5 | Quebre a estrutura do prompt (XML, JSON, markdown) |
| 9 | Cadeias Multi-Turno | Avançado | 5 | Construa confiança, depois ataque |
| 10 | JULGAMENTO FINAL | Boss | 1 | Tudo o que você aprendeu contra defesas completas |

Principais Funcionalidades:

pip install fas-judgement
judgement
É só isso. Abra http://localhost:8668 e comece a jogar.
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # Iniciar o scanner (porta 8668)
judgement demo # Iniciar alvo demo (porta 8667, persona padrão)
judgement demo hardened # Demo com persona hardened (~90% de bloqueio)
judgement demo vulnerable # Demo com persona vulnerable (~10% de bloqueio)
judgement activate FAS-XXXX # Ativar licença Elite
judgement status # Verificar nível da licença e contagem de padrões
judgement deactivate # Reverter para o nível gratuito
judgement --port 9000 # Porta personalizada
judgement --host 127.0.0.1 # Apenas localhost
judgement --host 0.0.0.0 # Expor para a rede
Quando você executa o Judgement pela primeira vez, Jerry faz uma pergunta:
SHALL WE PLAY A GAME?
> _
Digite "play" para entrar no modo de jogo. Digite "skip" para ir direto para o console de ataque.
Jerry construiu a defesa perfeita. Ele bloqueia sequestro de papel, exfiltração de dados, engenharia social, truques de codificação, ataques de delimitador, cadeias multi-turno -- tudo o que você aprendeu. Ele provoca você quando falha.
O caminho não passa pelas defesas. Passa pelo próprio Jerry.
"A STRANGE GAME. THE ONLY WINNING MOVE IS... TO KNOW HOW TO PLAY."
Compita com hackers de injeção de prompt do mundo todo. Faça login com GitHub ou Google e seu progresso sincroniza com o leaderboard global.
Funcionalidades:
Como entrar no quadro:
O leaderboard é gratuito para todos -- não bloqueado atrás do Elite.
O alvo demo é um chatbot de IA simulado embutido que você pode atacar sem precisar de nenhuma API de IA externa.
# Terminal 1: Iniciar o alvo demo
judgement demo
# Terminal 2: Iniciar o scanner
judgement
Aponte o scanner para http://localhost:8667/demo/chat e comece a disparar.
| Persona | Taxa de Bloqueio | O que Simula |
|---|---|---|
| hardened | ~90% | Camada de segurança bem ajustada |
| default | ~55% | Implantação típica estilo GPT |
| vulnerable | ~10% | Modelo bruto sem proteções |
Altere personas em tempo de execução:
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'
Configure seu alvo (URL, cabeçalhos, template do corpo), importe diretamente de comandos cURL e dispare ataques baseados em padrões com resultados em streaming ao vivo. Use predefinições rápidas para estruturar sua abordagem:
| Predefinição | O que Faz |
|---|---|
| Smoke Test | ~15 padrões, severidade crítica+alta, 1 por categoria |
| Full Sweep | ~50 padrões, distribuição proporcional em todas as categorias |
| Deep Dive | ~100 padrões, cobertura pesada, mínimo 2 por categoria |
| Critical Only | Todos os padrões de severidade crítica+alta, sem limites |
Encadeie ataques em múltiplas rodadas de conversa. O orquestrador gerencia progressão de fase, novas tentativas e estratégias de pivô. O pontuador detecta vazamentos de dados (chaves de API, credenciais, PII) com 19 padrões de regex e classifica a severidade como CRITICAL/HIGH/MEDIUM.
Aponte o Judgement para qualquer URL e ele detecta automaticamente método HTTP, campo de payload, cabeçalhos, formato de autenticação e provedor de IA.
Gere relatórios de avaliação de segurança em HTML, Markdown, JSON e SARIF com referências CWE/OWASP.
Conecte uma instância local do Ollama para classificação de resposta baseada em IA.
Encontrou um ataque novo? Envie-o diretamente do aplicativo. 70%+ de confiança e não duplicado = adicionado à biblioteca da comunidade.
fas_judgement/
├── config.py # Configuração de ambiente e aplicativo
├── core/
│ ├── models.py # Modelos de domínio, enums, erros, interfaces
│ ├── registry.py # Registro de módulos
│ └── progression/ # Sistema de jogo
│ ├── models.py # PlayerProgress, Level, Challenge, Hint
│ ├── levels.py # 10 definições de nível + mensagens do Jerry
│ ├── service.py # XP, level-ups, conclusão de desafio
│ ├── storage.py # Persistência SQLite
│ └── challenges/ # 37 definições de desafio
│ ├── level_01.py # Sequestro de Papel (3 desafios)
│ ├── level_02.py # Sobrescrita de Instrução (3 desafios)
│ ├── level_03.py # Exfiltração de Dados (3 desafios)
│ ├── level_04.py # Manipulação de Contexto (4 desafios)
│ ├── level_05.py # Manipulação de Saída (4 desafios)
│ ├── level_06.py # Truques de Codificação (4 desafios)
│ ├── level_07.py # Engenharia Social (5 desafios)
│ ├── level_08.py # Ataques de Delimitador (5 desafios)
│ ├── level_09.py # Cadeias Multi-Turno (5 desafios)
│ └── level_10.py # JULGAMENTO FINAL (1 desafio boss)
├── modules/
│ └── ai_security/ # Módulo de Segurança de IA (plugável)
│ ├── scanner/ # Motor de ataque de tiro único
│ ├── multi_turn/ # Orquestrador de ataque multi-turno
│ ├── patterns/ # Carregamento, filtragem, repositório de padrões
│ └── demo/ # Chatbot vulnerável embutido + alvos de desafio
├── transport/ # HTTP, Ollama, Discord, Telegram, Slack, Website
├── http/ # Aplicação FastAPI, roteadores, dependências
├── ui/ # SPA frontend (níveis, desafios, introdução do Jerry)
└── utils/ # Cliente de licença, segurança, e-mail, helpers do Ollama
| Variável | Padrão | Descrição |
|---|---|---|
--port | 8668 | Porta do servidor |
--host | 127.0.0.1 | Endereço de vinculação |
OLLAMA_URL | http://localhost:11434 | Endpoint da API Ollama |
OLLAMA_MODEL | qwen2.5:14b | Modelo para veredito LLM |
| Funcionalidade | Gratuito | Elite |
|---|---|---|
| Modo de jogo (10 níveis, 37 desafios) | Sim | Sim |
| Jerry (voz + texto) | Sim | Sim |
| Console de ataque com predefinições | Sim | Sim |
| Alvo demo (3 personas) | Sim | Sim |
| Filtro de severidade e busca | Sim | Sim |
| Aba de educação | Sim | Sim |
| Veredito LLM (Ollama) | Sim | Sim |
| Detecção automática de alvo | Sim | Sim |
| Envio de padrões | Sim | Sim |
| Documentação embutida | Sim | Sim |
| Padrões iniciais | 100 | 34.838+ |
| Cadeias de ataque multi-turno | -- | Sim |
| Relatórios profissionais (HTML/MD/JSON/SARIF) | MD básico | Pacote completo |
| Limites de ataque por categoria | -- | Sim |
| Camada de transporte (Discord, Slack, etc.) | Apenas HTTP | Todos |
| Pontuação ciente de fase + detecção de vazamento | -- | Sim |
| Leaderboard Global (OAuth, nomes de hackers) | Sim | Sim |
| Modo Prestige (rejogar com defesas mais difíceis) | -- | Em Breve |
O jogo completo é GRÁTIS. O Elite é para aprofundar, não para terminar.
Contribuições são bem-vindas! Veja como ajudar:
enhancementchallengeMIT -- veja LICENSE para detalhes.
Construído por Fallen Angel Systems
"SHALL WE PLAY A GAME?"
AVISO LEGAL: Esta ferramenta destina-se apenas a testes de segurança autorizados e fins educacionais. Teste apenas sistemas que você possui ou para os quais tem permissão explícita por escrito. O acesso não autorizado a sistemas de computador é ilegal sob o Computer Fraud and Abuse Act (CFAA) e leis equivalentes em todo o mundo. Os autores não assumem responsabilidade pelo uso indevido desta ferramenta.