#1Tools für LLM-Sicherheit, Prompt-Injection, Modellextraktion, adversariales KI und KI-Red-Teaming.
Kitploit empfohlen

Open-Source-Framework für Red-Teaming von generativen KI-Systemen: Angriffsprompts automatisieren, Modellantworten bewerten und Verhalten auditieren,…
ssh-chat in modernem C

Die umfassendste, kontinuierlich aktualisierte Sammlung der Community zu Forschung über Large Language Models zur Erkennung von…

Richtliniendurchsetzung, Zero-Trust-Identität, Ausführungssandboxing und Audit-Logging für autonome KI-Agenten. Deckt 10/10 des OWASP Agentic Top 10…

Eine sichere* Laufzeitumgebung für autonome KI-Agenten. Richtlinien aus Verfassungen in einfachem Englisch. (*https://ironcurtain.dev)

Open-Source-Repo zur Validierung von Agentic-AI-Anwendungen: Redteam, Verhalten, Supply-Chain, statische Analyse

Ein Alignment-Auditing-Agent, der in der Lage ist, Alignment-Hypothesen schnell zu erkunden

Autonomous AI pentesting agents — real-time reconnaissance, vulnerability detection, and exploitation orchestration. Go + TypeScript.

Angemessenes Sandboxing für agentisches Codieren und Web-Browsing

Sicherheitsscanner für KI/ML-Modelldateien. Erkennt bösartigen Code, Hintertüren und Schwachstellen vor der Bereitstellung.

Python-Bibliothek für die Sicherheit von Adversarial Machine Learning, die es Red- und Blue-Teams ermöglicht, Evasion-, Poisoning-, Extraction- und…

Erklärbares Sicherheitsgate für LLM-Apps — blockiert Prompt Injection mit einem nachvollziehbaren Grund für jede Entscheidung.

Programmierbare Guardrails für LLM-Chat-Apps: Eingabe-/Ausgabe-Regeln durchsetzen, Jailbreaks und Prompt-Injections blockieren, Halluzinationen…

Proxy-Server, der MCP-Server mit Verhaltensprofilerstellung, Sicherheitsscans, Risikobewertung und sicherer Ausführung umschließt. Erkennt…

Overlay-Netzwerkprotokoll, das KI-Agenten permanente Adressen, authentifizierte verschlüsselte Tunnel und ein Vertrauensmodell über UDP bietet.…

Ein Windows-Laufzeitanalyse-Toolkit, das Speicherscans, Debugging, Automatisierung und KI-freundliche APIs kombiniert.

Selbstgehostetes Evidenz-Gateway für KI-Systeme: Fail-Closed-Richtlinie, WAF, Egress-Kontrollen, signierte dauerhafte MMR-Nachweise und…

Eine leichte Alternative zu OpenClaw, die aus Sicherheitsgründen in Containern läuft. Verbindet sich mit WhatsApp, Telegram, Slack, Discord, Gmail…