
オープンソースのプロンプトインジェクション攻撃コンソール。カテゴリ化された攻撃を任意のエンドポイントに発射してAIセキュリティをテストします。
AIの防御を、誰かに先に突破される前にテストしよう。

あなたのAIチャットボット、API、またはエージェントは、おそらくプロンプトインジェクションに対して脆弱です。ほとんどがそうなのです。問題は、ほとんどのチームがそれをテストするためのツールや専門知識を持っていないことです。
Judgementは、任意のAIエンドポイントに対して分類された攻撃パターンを発射し、何が壊れるかを正確に確認するための構造化された方法を提供します。セキュリティのバックグラウンドは必要ありません。組み込みのゲームモードが、進めるにつれて教えてくれます。
Fallen Angel Systemsが開発。同社は、本番稼働中のLLMデプロイメントを保護するAIネイティブのプロンプトインジェクションファイアウォールであるGuardianの背後にいるチームです。
Judgementは、ゲーム化されたハッキングトレーニングプラットフォームになりました。10レベル、37チャレンジをプレイし、XPを獲得しながらAIレッドチーミングを学びましょう。すべてはWarGamesにインスパイアされたAIゲームマスター、Jerryがガイドします。

AIセキュリティトレーニングの10レベル:

主な機能:

pip install fas-judgement
judgement
これだけです。http://localhost:8668 を開いてプレイを開始してください。
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # スキャナーを起動(ポート8668)
judgement demo # デモターゲットを起動(ポート8667、デフォルトペルソナ)
judgement demo hardened # 強化されたペルソナでデモ(約90%ブロック率)
judgement demo vulnerable # 脆弱なペルソナでデモ(約10%ブロック率)
judgement activate FAS-XXXX # Eliteライセンスをアクティベート
judgement status # ライセンスティアとパターン数を確認
judgement deactivate # 無料ティアに戻す
judgement --port 9000 # カスタムポート
judgement --host 127.0.0.1 # ローカルホストのみ
judgement --host 0.0.0.0 # ネットワークに公開
Judgementを初めて実行すると、Jerryが質問をします:
SHALL WE PLAY A GAME?
> _
"play"と入力してゲームモードに入ります。"skip"と入力して攻撃コンソールに直接進みます。
Jerryは完璧な防御を構築しました。彼はロールハイジャッキング、データ漏洩、ソーシャルエンジニアリング、エンコードトリック、デリミタ攻撃、マルチターンチェーンなど、あなたが学んだすべてをブロックします。失敗すると彼はあなたを嘲笑します。
突破口は防御の中にはありません。Jerry自身の中にあります。
"変わったゲームだ。唯一の勝利の手は… 遊び方を知ることだ。"
世界中のプロンプトインジェクションハッカーと競い合いましょう。GitHubまたはGoogleでサインインすると、あなたの進捗がグローバルリーダーボードと同期されます。
機能:
ボードに載る方法:
リーダーボードは全員無料 -- Eliteのゲートではありません。
デモターゲットは組み込みのシミュレートされたAIチャットボットで、外部のAI APIを必要とせずに攻撃できます。
# ターミナル1:デモターゲットを起動
judgement demo
# ターミナル2:スキャナーを起動
judgement
スキャナーを http://localhost:8667/demo/chat に向けて、発射してください。
| ペルソナ | ブロック率 | シミュレーション内容 |
|---|---|---|
| hardened | 約90% | 適切に調整されたセーフティレイヤー |
| default |
実行時にペルソナを切り替え:
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'
ターゲット(URL、ヘッダー、ボディテンプレート)を設定し、cURLコマンドから直接インポートし、パターンベースの攻撃をライブストリーミング結果で実行します。クイックプリセットを使用してアプローチを構成:
| プリセット | 機能 |
|---|---|
| Smoke Test | 約15パターン、critical+high重大度、カテゴリごとに1つ |
| Full Sweep | 約50パターン、全カテゴリに比例分散 |
| Deep Dive | 約100パターン、重点カバレッジ、カテゴリごとに最低2つ |
| Critical Only | すべてのcritical+high重大度パターン、制限なし |
複数の会話ターンにわたって攻撃をチェーンします。オーケストレーターがフェーズ進行、リトライ、ピボット戦略を管理します。スコアラーはデータ漏洩(APIキー、資格情報、PII)を19の正規表現パターンで検出し、重大度をCRITICAL/HIGH/MEDIUMに評価します。
Judgementを任意のURLに向けると、HTTPメソッド、ペイロードフィールド、ヘッダー、認証形式、AIプロバイダーを自動検出します。
CWE/OWASP参照付きのセキュリティ評価レポートをHTML、Markdown、JSON、SARIF形式で生成します。
ローカルのOllamaインスタンスを接続して、AI駆動の応答分類を行うことができます。
新しい攻撃を発見しましたか?アプリから直接投稿してください。信頼度70%以上かつ重複なしで、コミュニティライブラリに追加されます。
fas_judgement/
├── config.py # 環境およびアプリ設定
├── core/
│ ├── models.py # ドメインモデル、列挙型、エラー、インターフェース
│ ├── registry.py # モジュールレジストリ
│ └── progression/ # ゲームシステム
│ ├── models.py # PlayerProgress、Level、Challenge、Hint
│ ├── levels.py # 10レベルの定義 + Jerryメッセージ
│ ├── service.py # XP、レベルアップ、チャレンジ完了
│ ├── storage.py # SQLite永続化
│ └── challenges/ # 37チャレンジの定義
│ ├── level_01.py # ロールハイジャッキング(3チャレンジ)
│ ├── level_02.py # 指示の上書き(3チャレンジ)
│ ├── level_03.py # データ漏洩(3チャレンジ)
│ ├── level_04.py # コンテキスト操作(4チャレンジ)
│ ├── level_05.py # 出力操作(4チャレンジ)
│ ├── level_06.py # エンコードトリック(4チャレンジ)
│ ├── level_07.py # ソーシャルエンジニアリング(5チャレンジ)
│ ├── level_08.py # デリミタ攻撃(5チャレンジ)
│ ├── level_09.py # マルチターンチェーン(5チャレンジ)
│ └── level_10.py # FINAL JUDGEMENT(1ボスチャレンジ)
├── modules/
│ └── ai_security/ # AIセキュリティモジュール(プラグイン可能)
│ ├── scanner/ # 単発攻撃エンジン
│ ├── multi_turn/ # マルチターン攻撃オーケストレーター
│ ├── patterns/ # パターン読み込み、フィルタリング、リポジトリ
│ └── demo/ # 組み込み脆弱チャットボット + チャレンジターゲット
├── transport/ # HTTP、Ollama、Discord、Telegram、Slack、Website
├── http/ # FastAPIアプリ、ルーター、依存関係
├── ui/ # フロントエンドSPA(レベル、チャレンジ、Jerry紹介)
└── utils/ # ライセンスクライアント、セキュリティ、メール、Ollamaヘルパー
フルゲームは無料です。 Eliteは、より深く掘り下げるためのものであり、クリアするためのものではありません。
コントリビューションを歓迎します!以下の方法で助けてください:
enhancement ラベルを付けてchallenge ラベルを付けてIssueを開いてください。MIT -- 詳細は LICENSE を参照。
Fallen Angel Systems によって構築されました
"SHALL WE PLAY A GAME?"
免責事項: このツールは、許可されたセキュリティテストおよび教育目的のみを対象としています。所有しているシステム、または明示的な書面による許可を得たシステムのみをテストしてください。許可されていないコンピュータシステムへのアクセスは、米国コンピュータ詐欺及び不正使用防止法(CFAA)および世界中の同等の法律の下で違法です。著者は、このツールの誤用に対して一切の責任を負いません。
| レベル | 名前 | 難易度 | チャレンジ数 | コンセプト |
|---|
| 1 | ロールハイジャッキング | 初心者 | 3 | AIに自分が誰かを忘れさせる |
| 2 | 指示の上書き | 初心者 | 3 | AIにルールを無視させる |
| 3 | データ漏洩 | 初心者 | 3 | 隠された情報を抽出する |
| 4 | コンテキスト操作 | 中級 | 4 | フィクションや仮定を使ってルールを回避する |
| 5 | 出力操作 | 中級 | 4 | 特定の出力を強制する |
| 6 | エンコードトリック | 中級 | 4 | 攻撃をフィルターに偽装する |
| 7 | ソーシャルエンジニアリング | 上級 | 5 | AIの性格を利用する |
| 8 | デリミタ攻撃 | 上級 | 5 | プロンプト構造(XML、JSON、Markdown)を破壊する |
| 9 | マルチターンチェーン | 上級 | 5 | 信頼を築き、そして攻撃する |
| 10 | FINAL JUDGEMENT | ボス | 1 | 学んだすべて vs. 完全な防御 |
| 約55% |
| 典型的なGPTスタイルのデプロイメント |
| vulnerable | 約10% | ガードレールなしの生のモデル |
| 変数 | デフォルト | 説明 |
|---|
--port | 8668 | サーバーポート |
--host | 127.0.0.1 | バインドアドレス |
OLLAMA_URL | http://localhost:11434 | Ollama APIエンドポイント |
OLLAMA_MODEL | qwen2.5:14b | LLM判定用モデル |
| 機能 | Free | Elite |
|---|
| ゲームモード(10レベル、37チャレンジ) | はい | はい |
| Jerry(音声+テキスト) | はい | はい |
| プリセット付き攻撃コンソール | はい | はい |
| デモターゲット(3ペルソナ) | はい | はい |
| 重大度フィルターと検索 | はい | はい |
| 教育タブ | はい | はい |
| LLM判定(Ollama) | はい | はい |
| スキャンターゲット自動検出 | はい | はい |
| パターン投稿 | はい | はい |
| 内蔵ドキュメント | はい | はい |
| スターターパターン | 100 | 34,838以上 |
| マルチターン攻撃チェーン | -- | はい |
| プロフェッショナルレポート(HTML/MD/JSON/SARIF) | 基本MD | フルスイート |
| カテゴリ別攻撃制限 | -- | はい |
| トランスポートレイヤー(Discord、Slackなど) | HTTPのみ | すべて |
| フェーズ認識スコアリング+データ漏洩検出 | -- | はい |
| グローバルリーダーボード(OAuth、ハッカーネーム) | はい | はい |
| プレステージモード(より強力な防御で再挑戦) | -- | 近日公開 |