#1Tools für LLM-Sicherheit, Prompt-Injection, Modellextraktion, adversariales KI und KI-Red-Teaming.
Kitploit empfohlen

Forschungscode für HARDE, ein Agent-Harness, das Komponenten für die Laufzeit-Risikoerkennung und Ausführungskontrolle über…

Bettet keybasierte, stilbasierte Wasserzeichen in LLM-generiertem Python-, Java- und C++-Code ein und erkennt sie mittels CST-Rewriting, wobei die…

Benchmark-Harness zur Messung, an welcher Stelle Prompt-Injection-Abwehrmechanismen in LLM-Agent-Pipelines mit Tool-Nutzung auslösen, wobei…

RAM-effizientes Terminal-Agent-Harness für Coding, Cybersicherheit und Automatisierung.

Proof-of-Concept-Exploit für CVE-2026-33017, eine nicht authentifizierte RCE im build_public_tmp-Endpunkt von Langflow, die eine bösartige…

Standard-Bibliothek-Python-Sicherheits-Triage-Engine, die Web-Apps, APIs, LLMs und mobile Pakete über passive Header-Inspektion, aktive…

AST-basierter statischer Code-Analysator mit agentischer, LLM-gestützter Beziehungszuordnung zur Entdeckung von Python-RCE-Pfaden und tiefen…

Windows-Kernel-Debugger mit OllyDbg/IDA-artiger Benutzeroberfläche, Software- und Hardware-Breakpoints, PDB-Symbolen, Decompiler und 17 Plugins für…

Kuratierter Index zu Deep-Learning-Latenz-, Energie-Latenz- und Timing-(Verfügbarkeits-)Angriffen und -Verteidigungen — Begleitmaterial zur…

Open-Weight-LLMs und Trainings-/Evaluierungscode zur Verteidigung gegen Prompt-Injection-Angriffe, mit Benchmarks für agentisches Tool-Calling und…

Human-in-the-loop-UI, die natürlichsprachliche oder C/C++-Protokollbeschreibungen in eine überprüfbare Protocol IR umwandelt und anschließend…

Benchmark- und Evaluierungs-Harness, der testet, ob LLM-Agenten bösartigen Anweisungen widerstehen, die in multimodalen Skill-Bildern verborgen sind,…

Agentisches Jailbreak-Framework für LLM-basierte Agenten, das schema-basierte Aufgabenzerlegung, mehrstufige Tarnungsstrategien und adaptive…

Evolutionäres LLM-Jailbreak- und Guardrail-Framework, das einen wiederverwendbaren Strategiepool durch genetische Mutation, Markov-Auswahl und…

Offenes Framework für RL-basiertes Red Teaming bei Prompt-Injection, mit einem gemeinsamen Trainer, Curriculum Learning und Benchmarks wie AgentDojo,…

Plugins, die Claude Code mit IDA Pro integrieren, um Reverse-Engineering- und Binäranalyse-Workflows durch KI-gesteuerte Disassemblierung und…

IDA Pro Plugin, der OpenAI GPT-3.5/GPT-4 nutzt, um Reverse-Engineering-Aufgaben wie Funktionsbenennung, Code-Erklärung und Analyse von dekompiliertem…

KI-gestützter Sicherheits-Copilot, der Schwachstellen erkennt, während du programmierst. Echtzeit-Sicherheitsscans, verständliche Erklärungen und…