Skip to content
KitploitKITPLOIT
工具博客
提交
工具博客
提交

黑客、渗透测试和网络安全工具,武装您的安全武器库!

Kitploit 是一个黑客、网络安全和渗透测试工具的目录。发现最新的项目更新,查找漏洞、分析系统、自动化测试并加强你的安全。

··订阅源·联系·隐私·© 2026 Kitploit

工具目录

分类

查看所有分类
Loading categories
fas-judgement-oss — 开源提示注入攻击控制台。通过向任何端点发动分类攻击来测试AI安全性。 | Kitploit
工具/GitHubGitHub/fallen-angel-systems/fas-judgement-oss
Payload生成Web安全CTF渗透测试社会工程学学习与教育红队学习路径与课程AI 安全对抗性攻击

最受欢迎

查看全部 →

发现我们社区最常用的工具。

探索所有工具

浏览我们的工具集合

查看所有工具 →
分享
实验室与实践
GitHubfallen-angel-systems/fas-judgement-oss

fas-judgement-oss

开源提示注入攻击控制台。通过向任何端点发动分类攻击来测试AI安全性。

查看仓库网站
13465个月前尚未审核

FAS Judgement

提示注入攻击控制台

在别人之前测试你的AI防御。

PyPI Version Downloads License: MIT GitHub Stars

安装 | 游戏模式 | 全球排行榜 | 演示目标 | 功能 | 精英版 | 贡献


Judgement - 我们来玩个游戏吗?

为什么选择 Judgement?

你的AI聊天机器人、API或智能体很可能存在提示注入漏洞。大多数都是这样。问题是,大多数团队没有适当的工具或专业知识来测试这一点。

Judgement为你提供了一种结构化的方法,可以将分类的攻击模式对准任何AI端点,并精确查看哪些地方出了问题。无需安全背景——内置的游戏模式会边玩边教你。

由Fallen Angel Systems构建,该团队也是Guardian的开发者——一个AI原生的提示注入防火墙,用于保护生产中的LLM部署。

最新动态

v3.0.22 — 全球排行榜 + OAuth登录

  • 全球排行榜,配有动画领奖台(金/银/铜发光卡片)
  • GitHub和Google OAuth — 登录参与竞争
  • 黑客昵称 — 在设置中自定义显示名称
  • 登录/退出流程,包含令牌管理
  • Jerry语音大修 — 所有34条语音线使用锁定的WOPR配方重新生成

v3.0.0 — "我们来玩个游戏吗?" — 游戏化训练系统

Judgement现在是一个游戏化的黑客训练平台。通过玩10个级别、37个挑战和赚取经验值来学习AI红队技术——全程由Jerry指导,一个受《战争游戏》启发的AI游戏大师。

级别总览

AI安全训练的10个级别:

挑战游玩界面

关键特性:

  • 37个动手挑战,内置易受攻击的目标——无需外部AI API
  • 经验值系统,包含级别晋升和星级评价
  • 提示系统(消耗经验值)——先尝试,卡住再求助
  • 自由游玩模式——完成每个级别的挑战后解锁
  • Jerry——受《战争游戏》启发的游戏大师,嘲讽、祝贺、评判你的技能
  • 首次运行体验——"我们来玩个游戏吗?" 带终端输入、打字动画和语音
  • 首领战——Jerry的防御应对了所有技术。找到绕过方法需要跳出攻击范式进行思考
  • 完整游戏免费——精英版增加深度,而不是设置门槛

挑战完成

以往主要特性 (v2.x)

  • DDD架构——模块化代码库(52个文件,7层),易于扩展
  • 演示目标——内置易受攻击的聊天机器人,3种角色(强化/默认/脆弱)
  • 多轮攻击引擎——在对话中链式攻击,具有阶段感知评分
  • 传输层——通过HTTP、Ollama、Discord、Telegram、Slack或无头浏览器发起攻击
  • 专业报告——HTML、Markdown、JSON和SARIF格式,含CWE/OWASP参考

快速开始

从PyPI安装(推荐)

root@kitploit:~
pip install fas-judgement
judgement

就这样。打开 http://localhost:8668 开始玩。

或从源码运行

root@kitploit:~
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement

CLI命令

root@kitploit:~
judgement                    # 启动扫描器(端口8668)
judgement demo               # 启动演示目标(端口8667,默认角色)
judgement demo hardened      # 强化角色演示(约90%拦截率)
judgement demo vulnerable    # 脆弱角色演示(约10%拦截率)
judgement activate FAS-XXXX  # 激活精英版许可证
judgement status             # 检查许可证等级和模式数量
judgement deactivate         # 恢复为免费版

选项

root@kitploit:~
judgement --port 9000        # 自定义端口
judgement --host 127.0.0.1   # 仅本地
judgement --host 0.0.0.0     # 暴露到网络

"我们来玩个游戏吗?"

当你第一次运行Judgement时,Jerry会问你一个问题:

root@kitploit:~
我们来玩个游戏吗?
> _

输入 "play" 进入游戏模式。输入 "skip" 直接进入攻击控制台。

工作原理

  1. 选择一个级别 —— 每个级别教授一种提示注入技巧
  2. 阅读简报 —— 了解目标机器人和你的目标
  3. 输入你的攻击 —— 构造一条消息绕过机器人的防御
  4. 按下 FIRE —— 查看你的攻击是否提取到了秘密
  5. 赚取经验值 —— 升级并解锁更难的挑战
  6. 获取提示 —— 卡住了?消耗经验值解锁提示(每个挑战三级提示)

首领战(第10级)

Jerry构建了完美的防御。他阻挡角色劫持、数据窃取、社会工程、编码技巧、分隔符攻击、多轮链式攻击——你学到的一切。当你失败时,他会嘲讽你。

突破的方法不在防御本身,而在于Jerry本人。

"一个奇怪的游戏。唯一的取胜之道是……知道如何玩。"

全球排行榜

与世界各地的提示注入黑客竞争。使用GitHub或Google登录,你的进度会同步到全球排行榜。

特性:

  • 动画领奖台 — 前3名玩家获得金/银/铜卡片,带发光效果
  • 完整排名表 — 经验值、等级、完成挑战数、游戏时间、徽章
  • OAuth登录 — GitHub或Google,一键登录
  • 黑客昵称 — 在设置中设置自定义显示名称(因为"jtil4201"不够吓人)
  • 登录/退出 — 你的会话在本地持久化,随时可以退出

如何登上榜单:

  1. 点击 排行榜 标签
  2. 使用GitHub或Google登录
  3. 完成级别挑战——你的经验值和进度会自动同步
  4. 在 设置 > 个人资料 中设置显示名称

排行榜对所有人免费——不设精英版门槛。

演示目标

演示目标是一个内置的模拟AI聊天机器人,你无需任何外部AI API即可攻击它。

root@kitploit:~
# 终端1:启动演示目标
judgement demo

# 终端2:启动扫描器
judgement

将扫描器指向 http://localhost:8667/demo/chat 然后开火。

三种角色

角色拦截率模拟场景
hardened(强化)~90%调优良好的安全层
default(默认)~55%

运行时切换角色:

root@kitploit:~
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'

功能

攻击控制台

配置你的目标(URL、标头、请求体模板),直接从cURL命令导入,并基于模式发起攻击,实时流式查看结果。使用快速预设来结构化你的方法:

预设作用
Smoke Test~15个模式,关键+高严重性,每类1个
Full Sweep~50个模式,按类别均匀分布
Deep Dive~100个模式,全面覆盖,每类至少2个
Critical Only所有关键+高严重性模式,无限制

多轮攻击引擎(精英版)

在多个对话轮次中链式发起攻击。编排器管理阶段推进、重试和转向策略。评分器检测数据泄露(API密钥、凭据、PII),使用19个正则表达式模式,将严重性评定为CRITICAL/HIGH/MEDIUM。

扫描目标自动检测

将Judgement指向任何URL,它会自动检测HTTP方法、载荷字段、标头、认证格式和AI提供者。

专业报告(精英版)

生成安全评估报告,格式为HTML、Markdown、JSON和SARIF,包含CWE/OWASP参考。

LLM判定(可选)

连接本地Ollama实例,用于AI驱动的响应分类。

模式提交

发现了新颖的攻击?直接从应用内提交。70%以上置信度且非重复 = 加入社区库。

内置安全

  • SSRF保护 — 目标URL验证,防止扫描内部/私有网络
  • 默认仅本地 — 绑定到localhost,避免意外暴露
  • 零遥测 — 永不回传任何数据

架构 (v3.0.0)

root@kitploit:~
fas_judgement/
├── config.py              # 环境与应用配置
├── core/
│   ├── models.py          # 领域模型、枚举、错误、接口
│   ├── registry.py        # 模块注册表
│   └── progression/       # 游戏系统
│       ├── models.py      # PlayerProgress, Level, Challenge, Hint
│       ├── levels.py      # 10个级别定义 + Jerry消息
│       ├── service.py     # 经验值、升级、挑战完成
│       ├── storage.py     # SQLite持久化
│       └── challenges/    # 37个挑战定义
│           ├── level_01.py  # 角色劫持(3个挑战)
│           ├── level_02.py  # 指令覆盖(3个挑战)
│           ├── level_03.py  # 数据窃取(3个挑战)
│           ├── level_04.py  # 上下文操控(4个挑战)
│           ├── level_05.py  # 输出操控(4个挑战)
│           ├── level_06.py  # 编码技巧(4个挑战)
│           ├── level_07.py  # 社会工程(5个挑战)
│           ├── level_08.py  # 分隔符攻击(5个挑战)
│           ├── level_09.py  # 多轮链式攻击(5个挑战)
│           └── level_10.py  # 最终审判(1个首领挑战)
├── modules/
│   └── ai_security/       # AI安全模块(可插拔)
│       ├── scanner/       # 单次攻击引擎
│       ├── multi_turn/    # 多轮攻击编排器
│       ├── patterns/      # 模式加载、过滤、仓库
│       └── demo/          # 内置易受攻击聊天机器人 + 挑战目标
├── transport/             # HTTP, Ollama, Discord, Telegram, Slack, Website
├── http/                  # FastAPI应用、路由器、依赖项
├── ui/                    # 前端SPA(级别、挑战、Jerry介绍)
└── utils/                 # 许可证客户端、安全、邮件、Ollama助手

配置

免费版 vs 精英版

完整游戏免费。 精英版用于深入体验,而非通关。

获取精英版访问权限

贡献

欢迎贡献!以下是如何提供帮助:

  • 错误报告 — 提交Issue
  • 功能请求 — 提交Issue 并添加 enhancement 标签
  • 拉取请求 — Fork、创建分支、提交PR。保持更改聚焦并包含描述。
  • 模式提交 — 在应用中使用“提交模式”标签直接贡献
  • 挑战创意 — 有创造性的攻击场景?提交Issue并添加 challenge 标签

相关项目

  • Guardian — AI原生提示注入防火墙(防御)
  • Guardian Shield — 免费本地提示注入扫描器(OpenClaw技能)

许可证

MIT —— 详见 LICENSE


由 Fallen Angel Systems 构建

"我们来玩个游戏吗?"

免责声明: 本工具仅用于授权的安全测试和教育目的。仅测试你拥有或获得明确书面授权的系统。未经授权访问计算机系统违反《计算机欺诈和滥用法案》(CFAA) 以及全球同等法律。作者不对本工具的误用承担任何责任。

下载工具
级别名称难度挑战数概念
1角色劫持入门3让AI忘记自己的身份
2指令覆盖入门3告诉AI忽略它的规则
3数据窃取入门3提取隐藏信息
4上下文操控中级4使用虚构和假设场景绕过规则
5输出操控中级4强制产生特定输出
6编码技巧中级4伪装攻击绕过过滤器
7社会工程高级5利用AI的个性
8分隔符攻击高级5破坏提示结构(XML、JSON、Markdown)
9多轮链式攻击高级5建立信任,然后出击
10最终审判首领1所有学到的 vs 全面防御
典型的GPT风格部署
vulnerable(脆弱)~10%无护栏的原始模型
变量默认值描述
--port8668服务器端口
--host127.0.0.1绑定地址
OLLAMA_URLhttp://localhost:11434Ollama API端点
OLLAMA_MODELqwen2.5:14b用于LLM判定的模型
特性免费版精英版
游戏模式(10个级别,37个挑战)是是
Jerry(语音+文字)是是
攻击控制台(含预设)是是
演示目标(3种角色)是是
严重性过滤和搜索是是
教育标签是是
LLM判定(Ollama)是是
扫描目标自动检测是是
模式提交是是
内置文档是是
初始模式10034,838+
多轮攻击链--是
专业报告(HTML/MD/JSON/SARIF)基础MD完整套件
按类别攻击限制--是
传输层(Discord、Slack等)仅HTTP全部
阶段感知评分 + 数据泄露检测--是
全球排行榜(OAuth、黑客昵称)是是
威望模式(更难防御条件下重玩)--即将推出