
awesome-ai-security
AIセキュリティに関連する素晴らしいリソースのコレクション

モバイルオンデバイスAIシステムの攻撃と防御研究に関する厳選された読書リストと分類法。敵対的攻撃、バックドア攻撃、モデル窃取攻撃、エネルギー遅延攻撃とともに、難読化、TEE、ウォーターマーキング防御を網羅しています。

攻撃者エミュレーションフレームワーク

ハードウェアブレークポイント(DR0-DR7)ベースのパッチ不要ユーザーモードフッキング&テレメトリ計測エンジン(AMSI、WLDP、ETW PoC)。

Self-Defeating Audits: 低権限のPostgreSQLロールがトリガーベースの監査者を可逆的に失明させ、さらに帰属(attribution)を汚染(ポイズニング)できることを示す再現可能なラボ(PG14/16)。防御策付き。合成データを使用。CVE-2018-1058のプリミティ…

オープンソースのAIセキュリティプラットフォーム。LLMやAIエージェントに対し、群解析、ポリシー適用、敵対的テスト、リアルタイム脅威検出を通じて境界防御を提供します。

vLLMのオフライン/サーバー検出パイプラインを備え、ログ確率に基づく軽量な挙動プローブをトレーニングすることで、LLMコンテキスト漏洩攻撃を検出します。

LLMセキュリティテストフレームワーク — プロンプトインジェクション、ジェイルブレイク、敵対的攻撃を検出。190以上のプローブ、28のプロバイダ、単一のGoバイナリ。

CVE-2026-44578 の Proof-of-concept エクスプロイトです。脆弱な状態を再現し、セキュリティ研究者が影響を受けるシステムを検証して緩和策を評価できるようにします。

The TTPForge is a Cybersecurity Framework for developing, automating, and executing attacker Tactics, Techniques, and Procedures (TTPs).

CVE-2026-73292 の概念実証エクスプロイト:Semaphore UI のパスワード変更エンドポイントに対する CSRF 攻撃で、認証済みユーザーのパスワードを気付かれずにリセットする悪意のあるページを配信します。

ペネトレーションテスター、バグハンター、セキュリティ研究者向けに厳選されたAIセキュリティ資料とリソースのリスト。

launchdのプライベートXPCインターフェースを介してmacOSプログラムをexecせずに起動し、EDRにlaunchdが親プロセスとして記録させます。ワンショット、KeepAlive、およびplistベースのジョブに対応しています。

オープンウェイトLLM向けローカル・ホワイトボックス勾配攻撃: レッドチーム向けのGCG/PEZサフィックス探索、レイヤー顕著性、重みスナップショット、およびランク1サフィックス-デルタフィッティング。

アプリケーションスコープのWindowsネットワークブラウンアウト(ネイティブCおよびBOF形式)

CVE-2026-6765 · Firefoxで公開されているFormAutofillハンドラーのみをテスト

LLMテキストの透かしをUnicode変異選択子を注入することで回避します。SynthIDジェネレーター、mean-g検出器、正規化防御、エントロピー実験を含みます。