
awesome-ai-security
Eine Sammlung großartiger Ressourcen zur KI-Sicherheit
Frameworks für adversariales ML-Angriffe, Umgehungstechniken und Tools zur Bewertung der Modellrobustheit.

Eine Sammlung großartiger Ressourcen zur KI-Sicherheit

Kuratierte Leseliste und Taxonomie der Angriffs- und Verteidigungsforschung für mobile On-Device-KI-Systeme, die adversarial-, Backdoor-,…

Angreifer-Emulations-Framework

Auf Hardware-Breakpoints (DR0-DR7) basierende, patch-lose User-Mode-Hooking- und Telemetrie-Instrumentierungs-Engine (AMSI, WLDP & ETW-PoC).

Self-Defeating Audits: reproduzierbares Lab, das zeigt, wie eine PostgreSQL-Rolle mit geringen Rechten einen triggerbasierten Auditor reversibel…

Open-Source-KI-Sicherheitsplattform, die Perimeterverteidigung für LLMs und KI-Agenten durch Schwarmanalyse, Richtliniendurchsetzung, adversariales…

Erkennt LLM-Context-Leakage-Angriffe durch Training leichtgewichtiger Verhaltens-Sonden auf Log-Wahrscheinlichkeiten, mit…

LLM-Sicherheitstestframework zur Erkennung von Prompt-Injection, Jailbreaks und adversarialen Angriffen — 190+ Sonden, 28 Anbieter, einzelne…

Proof-of-concept-Exploit für CVE-2026-44578, der den verwundbaren Zustand reproduziert und es Sicherheitsforschern ermöglicht, betroffene Systeme zu…

The TTPForge is a Cybersecurity Framework for developing, automating, and executing attacker Tactics, Techniques, and Procedures (TTPs).

Proof-of-Concept-Exploit für CVE-2026-73292: CSRF-Angriff auf den Endpunkt zur Passwortänderung der Semaphore-UI, der eine schädliche Seite…

Eine kuratierte Liste von KI-Sicherheitsmaterialien und -ressourcen für Pentester, Bug Hunter und Sicherheitsforscher.

Startet macOS-Programme über die private XPC-Schnittstelle von launchd, ohne sie per exec auszuführen, wodurch EDR launchd als Elternprozess…

Lokale White-Box-Gradientenangriffe für Open-Weight-LLMs: GCG/PEZ-Suffixsuche, Layer-Salienz, Gewichts-Snapshots und Rank-1-Suffix-zu-Delta-Fitting…

Anwendungsspezifische Windows-Netzwerk-Brownouts in nativem C und BOF-Form

CVE-2026-6765 · Nur die in Firefox offengelegten FormAutofill-Handler testen

Fully automatic censorship removal for language models

Umgeht LLM-Textwasserzeichen durch Einfügen von Unicode-Variationsselektoren; enthält den SynthID-Generator, den mean-g-Detektor,…