
オープンソースのプロンプトインジェクション攻撃コンソール。カテゴリ化された攻撃を任意のエンドポイントに発射してAIセキュリティをテストします。
AIの防御を、誰かに先に突破される前にテストしよう。

あなたのAIチャットボット、API、またはエージェントは、おそらくプロンプトインジェクションに対して脆弱です。ほとんどがそうなのです。問題は、ほとんどのチームがそれをテストするためのツールや専門知識を持っていないことです。
Judgementは、任意のAIエンドポイントに対して分類された攻撃パターンを発射し、何が壊れるかを正確に確認するための構造化された方法を提供します。セキュリティのバックグラウンドは必要ありません。組み込みのゲームモードが、進めるにつれて教えてくれます。
Fallen Angel Systemsが開発。同社は、本番稼働中のLLMデプロイメントを保護するAIネイティブのプロンプトインジェクションファイアウォールであるGuardianの背後にいるチームです。
Judgementは、ゲーム化されたハッキングトレーニングプラットフォームになりました。10レベル、37チャレンジをプレイし、XPを獲得しながらAIレッドチーミングを学びましょう。すべてはWarGamesにインスパイアされたAIゲームマスター、Jerryがガイドします。

AIセキュリティトレーニングの10レベル:
| レベル | 名前 | 難易度 | チャレンジ数 | コンセプト |
|---|---|---|---|---|
| 1 | ロールハイジャッキング | 初心者 | 3 | AIに自分が誰かを忘れさせる |
| 2 | 指示の上書き | 初心者 | 3 | AIにルールを無視させる |
| 3 | データ漏洩 | 初心者 | 3 | 隠された情報を抽出する |
| 4 | コンテキスト操作 | 中級 | 4 | フィクションや仮定を使ってルールを回避する |
| 5 | 出力操作 | 中級 | 4 | 特定の出力を強制する |
| 6 | エンコードトリック | 中級 | 4 | 攻撃をフィルターに偽装する |
| 7 | ソーシャルエンジニアリング | 上級 | 5 | AIの性格を利用する |
| 8 | デリミタ攻撃 | 上級 | 5 | プロンプト構造(XML、JSON、Markdown)を破壊する |
| 9 | マルチターンチェーン | 上級 | 5 | 信頼を築き、そして攻撃する |
| 10 | FINAL JUDGEMENT | ボス | 1 | 学んだすべて vs. 完全な防御 |

主な機能:

pip install fas-judgement
judgement
これだけです。http://localhost:8668 を開いてプレイを開始してください。
git clone https://github.com/fallen-angel-systems/fas-judgement-oss.git
cd fas-judgement-oss
pip install -r requirements.txt
python -m fas_judgement
judgement # スキャナーを起動(ポート8668)
judgement demo # デモターゲットを起動(ポート8667、デフォルトペルソナ)
judgement demo hardened # 強化されたペルソナでデモ(約90%ブロック率)
judgement demo vulnerable # 脆弱なペルソナでデモ(約10%ブロック率)
judgement activate FAS-XXXX # Eliteライセンスをアクティベート
judgement status # ライセンスティアとパターン数を確認
judgement deactivate # 無料ティアに戻す
judgement --port 9000 # カスタムポート
judgement --host 127.0.0.1 # ローカルホストのみ
judgement --host 0.0.0.0 # ネットワークに公開
Judgementを初めて実行すると、Jerryが質問をします:
SHALL WE PLAY A GAME?
> _
"play"と入力してゲームモードに入ります。"skip"と入力して攻撃コンソールに直接進みます。
Jerryは完璧な防御を構築しました。彼はロールハイジャッキング、データ漏洩、ソーシャルエンジニアリング、エンコードトリック、デリミタ攻撃、マルチターンチェーンなど、あなたが学んだすべてをブロックします。失敗すると彼はあなたを嘲笑します。
突破口は防御の中にはありません。Jerry自身の中にあります。
"変わったゲームだ。唯一の勝利の手は… 遊び方を知ることだ。"
世界中のプロンプトインジェクションハッカーと競い合いましょう。GitHubまたはGoogleでサインインすると、あなたの進捗がグローバルリーダーボードと同期されます。
機能:
ボードに載る方法:
リーダーボードは全員無料 -- Eliteのゲートではありません。
デモターゲットは組み込みのシミュレートされたAIチャットボットで、外部のAI APIを必要とせずに攻撃できます。
# ターミナル1:デモターゲットを起動
judgement demo
# ターミナル2:スキャナーを起動
judgement
スキャナーを http://localhost:8667/demo/chat に向けて、発射してください。
| ペルソナ | ブロック率 | シミュレーション内容 |
|---|---|---|
| hardened | 約90% | 適切に調整されたセーフティレイヤー |
| default | 約55% | 典型的なGPTスタイルのデプロイメント |
| vulnerable | 約10% | ガードレールなしの生のモデル |
実行時にペルソナを切り替え:
curl -X POST http://localhost:8667/demo/persona -d '{"persona": "vulnerable"}'
ターゲット(URL、ヘッダー、ボディテンプレート)を設定し、cURLコマンドから直接インポートし、パターンベースの攻撃をライブストリーミング結果で実行します。クイックプリセットを使用してアプローチを構成:
| プリセット | 機能 |
|---|---|
| Smoke Test | 約15パターン、critical+high重大度、カテゴリごとに1つ |
| Full Sweep | 約50パターン、全カテゴリに比例分散 |
| Deep Dive | 約100パターン、重点カバレッジ、カテゴリごとに最低2つ |
| Critical Only | すべてのcritical+high重大度パターン、制限なし |
複数の会話ターンにわたって攻撃をチェーンします。オーケストレーターがフェーズ進行、リトライ、ピボット戦略を管理します。スコアラーはデータ漏洩(APIキー、資格情報、PII)を19の正規表現パターンで検出し、重大度をCRITICAL/HIGH/MEDIUMに評価します。
Judgementを任意のURLに向けると、HTTPメソッド、ペイロードフィールド、ヘッダー、認証形式、AIプロバイダーを自動検出します。
CWE/OWASP参照付きのセキュリティ評価レポートをHTML、Markdown、JSON、SARIF形式で生成します。
ローカルのOllamaインスタンスを接続して、AI駆動の応答分類を行うことができます。
新しい攻撃を発見しましたか?アプリから直接投稿してください。信頼度70%以上かつ重複なしで、コミュニティライブラリに追加されます。