Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
Tools/GitHubGitHub/0xsteph/pentest-ai-agents
Penetrationstest-FrameworksAufklärungSchwachstellenscannerExploit-FrameworksWebsicherheitPenetrationstestsCloud-SicherheitMobile SicherheitLernen & BildungRed TeamingKI-Sicherheit
2.1k403vor 4 TagenVon Kitploit geprüft

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
GitHub
0xsteph/pentest-ai-agents

pentest-ai-agents

Repository anzeigenWebseite

Über

Verwandle Claude Code in deinen Assistenten für offensive Sicherheitsforschung. Spezialisierte KI-Subagenten für autorisierte Penetrationstests: Planung von Engagements, Analyse von Recon-Daten, Recherche von Exploits, Erstellung von Detections, Prüfung von STIGs und Verfassen von Berichten.

Teilen

pentest-ai-agents

50 Claude Code-Subagenten für Penetrationstests.

License: MIT Claude Code Agents Tools Tracked GitHub stars

Schnellstart | Spickzettel | Abdeckung | Agenten | Beispiele


Inhaltsverzeichnis

  • Neuerungen in v3.3
  • Neuerungen in v3.2
  • Agentenübersicht
  • Neuerungen in v3.1
  • Schnellstart
  • Spickzettel
  • Abdeckung
  • Agenten
  • Tier 1 vs Tier 2
  • Beispiele
  • Tools in einem Container ausführen
  • Findings-Datenbank
  • Token-Optimierung
  • Lokale Modelle
  • Dokumentation
  • MCP-Server
  • Voraussetzungen
  • Rechtliches
  • Lizenz

pentest-ai-agents ist eine Sammlung von 50 Claude-Code-Subagenten, die Claude in einen Assistenten für offensive Sicherheitsforschung verwandeln. Jeder Agent verfügt über tiefes Fachwissen in einem bestimmten Bereich: Recon, Web, Active Directory, Cloud, Mobile, Wireless, Social Engineering, Payload-Erstellung, Reverse Engineering, Exploit-Verkettung, Detection Engineering, Forensik und mehr.

Installiere die Agent-Dateien. Öffne Claude Code. Beschreibe deine Aufgabe. Claude leitet automatisch an den richtigen Spezialisten weiter.

Keine Server, keine Python-Abhängigkeiten, keine Einrichtung – nur Dateien kopieren.

Neuerungen in v3.3

  • Als Claude-Code-Plugin installierbar. Zwei Zeilen — /plugin marketplace add 0xSteph/pentest-ai-agents, dann /plugin install pentest-ai-agents@pentest-ai-agents. Der install.sh-curl-Pfad funktioniert weiterhin unverändert.
  • 15 neue Agenten (35 → 50): ai-recon (KI-Angriffsflächen-Mapping), code-auditor, crypto-analyzer, password-auditor, database-attacker, network-attacker, traffic-analyzer, compliance-mapper, risk-scorer, plus das Post-Exploitation-Set — evasion-specialist, , , , , . Jeder offensive Agent kombiniert seine Techniken mit der Erkennung, die sie trainieren.

Neuerungen in v3.2

  • 4 neue Agenten: c2-operator (Sliver/Mythic/Havoc/Cobalt-Strike-Profil-Tuning, Beacon-Hygiene, Redirector-Design), container-breakout (Docker/K8s-Escape, runc/cri-o-CVEs, Kubelet-Exploitation, RBAC-Missbrauch), opsec-anonymizer (operatorseitige Identitäts-Hygiene, Quell-IP-Design, Burner-Infrastruktur, Fingerprint-Hygiene), llm-redteam (OWASP-LLM-Top-10-Tests, Prompt-Injection, RAG-Vergiftung, MCP-Server-Missbrauch, Missbrauch von Agent-Tools).
  • Verschärfter Scope-Guard: eine explizite Hard-Refusal-Liste in _scope-guard.md deckt DoS, Massen-Scans, unbeaufsichtigte Würmer, False-Flag-Operationen und Systeme, die die Sicherheit von Menschenleben betreffen, ab.
  • Findings-DB v2: eine Spalte vulns.tool_used zum Filtern von Findings nach dem Tool, das sie erzeugt hat; neue Indizes auf cve und tool_used. Bestehende Engagements werden über db/migrate.sh migriert.
  • Agentenübersichts-Diagramm: visueller Ablauf von Recon bis Abschluss, abgebildet auf Agentennamen (siehe unten).

Agentenübersicht```mermaid

flowchart LR classDef plan fill:#1a2a4a,stroke:#5a7ab8,color:#eaf0ff classDef recon fill:#1a3a2a,stroke:#5ab87a,color:#eaffea classDef exploit fill:#3a1a1a,stroke:#b85a5a,color:#ffeaea classDef post fill:#3a2a1a,stroke:#b8895a,color:#fff0ea classDef defense fill:#1a3a3a,stroke:#5ab8b8,color:#eaffff classDef report fill:#2a1a3a,stroke:#895ab8,color:#f0eaff

root@kitploit:~
EP[engagement-planner]:::plan
OA[opsec-anonymizer]:::plan
TM[threat-modeler]:::plan

OS[osint-collector]:::recon
RA[recon-advisor]:::recon
VS[vuln-scanner]:::recon

WH[web-hunter]:::exploit
AS[api-security]:::exploit
BL[bizlogic-hunter]:::exploit
BB[bug-bounty]:::exploit
AD[ad-attacker]:::exploit
CS[cloud-security]:::exploit
MP[mobile-pentester]:::exploit
WP[wireless-pentester]:::exploit
LR[llm-redteam]:::exploit
SE[social-engineer]:::exploit
PO[phishing-operator]:::exploit
CT[ctf-solver]:::exploit
CR[credential-tester]:::exploit
PV[poc-validator]:::exploit
EG[exploit-guide]:::exploit
EC[exploit-chainer]:::exploit
AP[attack-planner]:::exploit
PC[payload-crafter]:::exploit
RE[reverse-engineer]:::exploit

PE[privesc-advisor]:::post
CB[container-breakout]:::post
C2[c2-operator]:::post
CI[cicd-redteam]:::post
SO[swarm-orchestrator]:::post

DE[detection-engineer]:::defense
FA[forensics-analyst]:::defense
MA[malware-analyst]:::defense
SA[stig-analyst]:::defense

RG[report-generator]:::report

EP --> OA --> OS
EP --> TM
OS --> RA --> VS
VS --> WH & AS & BL & BB & AD & CS & MP & WP & LR
SE --> PO
BB --> WH
PO --> PC --> C2
AD --> CR
AD --> PE
CS --> CB
CB --> PE
WH --> PV
AS --> PV
PV --> EC --> AP
EC --> EG
PC --> RE
RE --> MA
AP --> SO
C2 --> DE
SO --> RG
DE --> FA
MA --> RG
SA --> RG
CT -.solo.-> RG
CI -.pipeline.-> SO
root@kitploit:~
Tier 1 (beratende) Agenten sind von jeder Aufgabe aus ansteuerbar. Tier 2 (ausführungsfähige) Agenten erfordern einen deklarierten Scope und befinden sich im Cluster für offensive Operationen.

## Neuerungen in v3.1

- **3 neue Agenten**: `payload-crafter` (msfvenom, Donut, benutzerdefinierte Loader), `reverse-engineer` (Ghidra, JadX, Radare2, Binwalk), `phishing-operator` (Evilginx, GoPhish, dnstwist)
- **Slash-Befehle**: `/recommend "Freitextaufgabe"` leitet dich zum richtigen Agenten + zu konkreten Befehlen. `/agents-for <tag>` filtert den Katalog nach Domäne.
- **`db/doctor.sh`**: prüft, welche zugrunde liegenden CLI-Tools auf deinem System installiert sind, gruppiert nach Agent. Zeigt `✔` und `✘` pro Tool mit Installationshinweisen.
- **`install.sh --tools`**: Opt-in-Installer, der die zugrunde liegenden Tools via apt/brew/pacman + pipx/go/cargo nachzieht.
- **Erweiterte Agenten**: Commix zu web-hunter hinzugefügt, RouterSploit zu vuln-scanner hinzugefügt, gezielte Wortlistengenerierung (cupp, CeWL, Mentalist, Crunch, hashid, haiti) zu credential-tester hinzugefügt, vollständiges Steganografie-Toolkit zu ctf-solver hinzugefügt.

## Schnellstart

Ein Befehl:```bash
curl -fsSL https://raw.githubusercontent.com/0xSteph/pentest-ai-agents/main/install.sh | bash

Das war's. Das Skript klont das Repository in ein temporäres Verzeichnis, kopiert die Agents nach ~/.claude/agents/ und beendet sich. Idempotent: Kann sicher erneut ausgeführt werden, um Updates zu erhalten.

Oder als Claude Code-Plugin installieren (kein Klonen; Updates über den Marketplace):``` /plugin marketplace add 0xSteph/pentest-ai-agents /plugin install pentest-ai-agents@pentest-ai-agents

root@kitploit:~
Dadurch werden alle 52 Agents und die Slash-Befehle über das Plugin-System von Claude Code registriert. Wähle das Plugin **oder** den Installer — du brauchst nicht beides.

Öffne dann Claude Code:```
"Plan an internal network pentest for a 500-endpoint AD environment with a 2-week window."

Claude leitet an den Engagement-Planer-Agenten weiter und erstellt einen phasenweisen Plan mit MITRE-ATT&CK-Zuordnungen.

Möchten Sie lieber zuerst klonen?```bash git clone https://github.com/0xSteph/pentest-ai-agents.git cd pentest-ai-agents && ./install.sh --global

root@kitploit:~
**Weitere Installationsoptionen:**```bash
./install.sh --project     # Install for current project only
./install.sh --global --lite  # Use Haiku for advisory agents (lower cost)
./install.sh --tools       # Install underlying CLI tools (nmap, nuclei, ffuf, etc.)
./install.sh --help        # All options

Siehe INSTALL.md für Schritt-für-Schritt-Anleitungen, einschließlich der Ersteinrichtung von Claude Code.


Spickzettel

Schnelle Interaktionen nach der Installation:

In Claude Code genügt es, deine Aufgabe zu beschreiben – die Weiterleitung erfolgt automatisch:``` "Plan an internal pentest for a 500-endpoint AD environment, 2-week window." "I have a domain user, where do I look first in BloodHound?" "Convert this SharpHound EXE into shellcode for an EDR test, with detection content." "Reverse this firmware image and tell me what the cryptographic protocol looks like." "Run a phishing simulation against acme-corp.com, set up GoPhish + Evilginx infrastructure."

root@kitploit:~
---

## Abdeckung

Womit die Agents arbeiten. Die Kategorien entsprechen derselben Angriffsfläche, über die echte Gegner operieren:

| Kategorie | Agents | Zugrunde liegende Tools (installierbar über `install.sh --tools`) |
|----------|--------|--------------------------------------------------------|
| **Recon und OSINT** | recon-advisor, osint-collector | nmap, masscan, rustscan, dig, whois, subfinder, amass, httpx, theHarvester, sherlock, holehe, maigret |
| **Schwachstellen-Scanning** | vuln-scanner | nuclei, nikto, RouterSploit, nmap NSE, OpenVAS/Nessus-Parsing |
| **Web-App-Tests** | web-hunter, api-security, bug-bounty, bizlogic-hunter | ffuf, gobuster, feroxbuster, sqlmap, dalfox, Commix, dirsearch, whatweb |
| **Active Directory** | ad-attacker, credential-tester | BloodHound, Impacket, NetExec/CrackMapExec, Certipy, kerbrute, Responder, ldapsearch |
| **Anmeldedaten und Cracking** | credential-tester, password-auditor | Hydra, Hashcat, John, Medusa, cupp, CeWL, NIST-800-63B-Richtlinienprüfung, HIBP-k-Anonymität |
| **Cloud** | cloud-security, cicd-redteam | aws/az/gcloud CLIs, Trivy, Prowler, ScoutSuite, Pacu |
| **Container- und K8s-Ausbruch** | container-breakout | kubectl, kube-hunter, peirates, CDK, Falco-Regelkopplung |
| **C2-Operationen** | c2-operator | Sliver, Mythic, Havoc, Cobalt Strike, malleable Profile, Redirector-Design |
| **AI-/LLM-Red-Teaming** | ai-recon, llm-redteam | A2A/MCP/RAG-Oberflächenermittlung, Modell-Fingerprinting, Garak, PyRIT, Promptfoo, OWASP LLM Top 10, MITRE ATLAS |
| **Operator-OpSec** | opsec-anonymizer | Source-IP-Design, Wegwerf-Identität, JA3-/Fingerprint-Hygiene, Burn-Checklisten |
| **Mobile** | mobile-pentester, reverse-engineer | Frida, Objection, jadx, apktool, MobSF, adb |
| **Wireless** | wireless-pentester | aircrack-ng, hcxdumptool, hcxtools, bettercap, wifite |
| **Social Engineering** | social-engineer, phishing-operator | GoPhish, Evilginx, dnstwist, Modlishka |
| **Payload-Erstellung** | payload-crafter | msfvenom, Donut, MSFvenom Payload Creator, benutzerdefinierte Loader-Muster |
| **Reverse Engineering** | reverse-engineer, malware-analyst | Ghidra, Radare2, JadX, Binwalk, Apktool, IDA, dnSpy, Volatility 3 |
| **Forensik und IR** | forensics-analyst, malware-analyst | Volatility 3, exiftool, foremost, YARA, Wireshark/tshark, Autopsy |
| **Exploit-Verkettung** | exploit-chainer, attack-planner, poc-validator | Mehrstufige Angriffskomposition, ATT&CK-zugeordnete Kettenbewertung |
| **Datenbank-Angriffe** | database-attacker | sqlmap, NoSQLMap, native Clients (MySQL/PostgreSQL/MSSQL/Oracle/MongoDB/Redis) |
| **Netzwerk L2/L3 und Traffic** | network-attacker, traffic-analyzer | Responder, ntlmrelayx, mitm6, bettercap, Wireshark/tshark, Zeek |
| **Post-Exploitation** | lateral-movement, persistence-planner, evasion-specialist, data-exfiltrator | PtH/PtT, WMI/WinRM/DCOM, AMSI/ETW-Umgehung, DNS/HTTPS-Exfiltration, Golden Ticket |
| **ICS / OT** | scada-attacker | Modbus, DNP3, S7comm, EtherNet/IP, OPC-UA, OT-bewusste IDS-Kopplung |
| **IoT / eingebettete Systeme** | iot-pentester | binwalk, UART/JTAG/SPI, BLE/Zigbee/sub-GHz, Firmware-Analyse |
| **Sicherer Code und Krypto** | code-auditor, crypto-analyzer | Semgrep, CodeQL, gitleaks, testssl.sh, jwt_tool |
| **Erkennung und Verteidigung** | detection-engineer, threat-modeler, stig-analyst | Sigma, Splunk SPL, Elastic KQL, Sentinel KQL, STRIDE/DREAD, DISA STIG |
| **CTF** | ctf-solver | zsteg, steghide, stegseek, pngcheck, plus generische Toolchain |
| **Reporting, Risiko und Compliance** | engagement-planner, report-generator, risk-scorer, compliance-mapper | MITRE-ATT&CK-Mapping, CVSS 3.1/4.0, EPSS, CISA KEV, PCI/NIST/ISO/CIS-Mapping |

Führe `bash db/doctor.sh` aus, um zu sehen, welche davon derzeit auf deinem System vorhanden sind und was fehlt.

---

## Agents

### Offensive Operationen

| Agent | Was er tut |
|-------|-------------|
| **Engagement Planner** | Phasenweise Pentest-Pläne mit MITRE-ATT&CK-Zuordnungen, Zeitschätzungen und ROE-Vorlagen |
| **Recon Advisor** | Parst Nmap-/Nessus-/BloodHound-Ausgaben, priorisiert Ziele, empfiehlt nächste Befehle. *Tier 2: führt Recon-Tools direkt aus.* |
| **OSINT Collector** | Domain-Recon, E-Mail-Sammlung, Social-Media-Profiling, Analyse von Datenleck-Daten |
| **Exploit Guide** | Angriffsmethodik für AD, Web, Cloud und Post-Exploitation mit defensiver Perspektive |
| **Privilege Escalation** | Linux- und Windows-Privilege Escalation: SUID, Tokens, Dienste, Kernel-Exploits, Container-Escape |
| **Cloud Security** | AWS-/Azure-/GCP-Pentesting: IAM-Eskalation, Container-Escape, Serverless-Exploitation |
| **API Security** | REST-, GraphQL-, WebSocket-Tests. OWASP API Top 10, JWT-Angriffe, OAuth-Exploitation |
| **Mobile Pentester** | Android-/iOS-Analyse mit Frida, Objection, jadx. OWASP-MASTG/MASVS-Zuordnung |
| **Wireless Pentester** | WPA/WPA2/WPA3, Evil Twin, Rogue-AP, Enterprise-802.1X, Bluetooth-Sicherheit |
| **Social Engineer** | Phishing-Kampagnen, Pretexting, Vishing für autorisierte Red-Team-Einsätze |
| **Vuln Scanner** | Nuclei-, Nikto-, Nmap-NSE-Scans. Parst Nessus-/OpenVAS-Ergebnisse. *Tier 2: führt Scans aus.* |
| **Web Hunter** | ffuf, gobuster, sqlmap, dalfox. Content Discovery, Fuzzing, WAF-Erkennung. *Tier 2: führt Web-Tools aus.* |
| **Credential Tester** | Hydra, Hashcat, John, CrackMapExec. Hash-Identifikation, Wörterlistengenerierung |
| **Attack Planner** | Korreliert Befunde zu mehrstufigen Angriffsketten. Bewertet nach Wahrscheinlichkeit, Tarnung und Auswirkung |
| **Supply Chain Auditor** | SBOM-Inventar, Dependency-Confusion- und Typosquatting-Risiken, Review von Install-Hooks, Integrität von Lockfiles und Provenienz |
| **Bug Bounty Hunter** | HackerOne-/Bugcrowd-Methodik, Vermeidung von Duplikaten, Report-Erstellung für maximale Auszahlung |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy. Kerberos-, Delegations-, ACL- und Zertifikats-Missbrauch. *Tier 2: führt AD-Tools aus.* |
| **Exploit Chainer** | Verkettet Befunde mit geringer Schwere zu vollständigen Kompromittierungspfaden. Schrittweise mit Genehmigungspunkten. *Tier 2.* |
| **PoC Validator** | Erzeugt und führt Proof-of-Concept-Skripte sicher aus. Eliminiert Fehlalarme. *Tier 2.* |
| **Payload Crafter** | msfvenom, Donut, benutzerdefinierte Loader. Kombiniert jedes Payload mit YARA-/Sigma-Erkennungsinhalten. |
| **Reverse Engineer** | Ghidra, JadX, Radare2, Binwalk. Statische Analyse von Firmware, mobilen Apps und Binärdateien. |
| **Phishing Operator** | Evilginx-, GoPhish-, dnstwist-Infrastruktur. Live-Kampagnen-Tooling für autorisierte Red Teams. |
| **Swarm Orchestrator** | Koordiniert alle Agents als Red-Team-Schwarm. Parallele Arbeitsströme, Fortschrittsverfolgung. |
| **Business Logic Hunter** | Preismanipulation, Workflow-Bypass, Race Conditions, Autorisierungsfehler. *Tier 2.* |
| **CI/CD Red Team** | GitHub Actions, GitLab CI, Jenkins-Pipeline-Konfigurationen mit Sicherheits-Gates |
| **C2 Operator** | Sliver, Mythic, Havoc, Cobalt Strike. Listener-Tuning, Beacon-Hygiene, Redirector-Design, Engagement-Burn |
| **Container Breakout** | Docker-/K8s-Escape, runc/cri-o-CVEs, kubelet-Exploitation, RBAC-Missbrauch, Admission-Controller-Bypass |
| **OpSec Anonymizer** | Identitätshygiene auf Operator-Seite, Source-IP-Strategie, Wegwerf-Infrastruktur, Browser-/JA3-Fingerprint-Hygiene |
| **LLM Red Team** | OWASP-LLM-Top-10-Tests, Prompt-Injection, RAG-Poisoning, Missbrauch von Agent-Tools, MCP-Server-Exploitation |
| **AI Recon** | Kartiert die KI-Angriffsfläche: KI-/LLM-Endpunkte, A2A-Agent-Cards, MCP-Exposition, RAG-/Tool-Oberfläche, Modell-Fingerprint. *Tier 2: führt schreibgeschützte Recon durch.* |
| **Password Auditor** | NIST-800-63B-Richtlinien- und Hash-Speicher-Audit, Leak-Exposition (HIBP-k-Anonymität), Lockout-sichere Spray-Planung |
| **Database Attacker** | SQL-/NoSQL-Injection-Tiefe, DB-Privilegieneskalation, beweisbegrenzte Extraktion über gängige Engines hinweg. *Tier 2.* |
| **Network Attacker** | LLMNR-/NBT-NS-Poisoning, NTLM-Relay, mitm6, ARP-MITM, Pivoting. *Tier 2: führt L2/L3-Angriffe aus.* |
| **Evasion Specialist** | AV-/EDR-Umgehung, AMSI/ETW-Bypass, In-Memory-Ausführung – jede Technik mit zugehöriger Erkennung |
| **Persistence Planner** | Host-/AD-/Cloud-Persistenz (Golden Ticket, WMI, Dienste) mit verpflichtender Cleanup-Verfolgung + Erkennung |
| **Data Exfiltrator** | DNS-/HTTPS-/ICMP-Exfiltration und DLP-/Egress-Tests mit synthetischen/Canary-Daten – gepaart mit Erkennung |
| **SCADA Attacker** | ICS/OT-Protokollanalyse (Modbus/DNP3/S7comm/OPC-UA), sicherheitsgesteuert, passiv zuerst |
| **IoT Pentester** | Firmware, Hardware-Schnittstellen (UART/JTAG), Funk (BLE/sub-GHz) und Device-Cloud-Tests |
| **Lateral Movement** | PtH/PtT, WMI/WinRM/DCOM/SSH, Token-Diebstahl, Pivot-Planung – gepaart mit Erkennung |

### Verteidigung und Analyse

| Agent | Was er tut |
|-------|-------------|
| **Fix Verifier** | Testet einen Befund nach einem Patch erneut. Spielt den ursprünglichen Beweis erneut ab, testet die Klasse statt des Strings und markiert Teil-Fixes und Regressionen |
| **Detection Engineer** | Sigma-, Splunk-SPL-, Elastic-KQL-, Sentinel-KQL-Regeln mit Fehlalarm-Optimierung |
| **Threat Modeler** | STRIDE-/DREAD-Analyse, Angriffsbäume, Datenflussdiagramme |
| **Forensics Analyst** | Beweissicherung, Memory-Forensik, Festplattenanalyse, Timeline-Erstellung |
| **Malware Analyst** | Statische/dynamische Analyse, Reverse Engineering, YARA-Regeln, IOC-Extraktion |
| **STIG Analyst** | DISA-STIG-Compliance, GPO-Behebungspfade, Vorlagen für Keep-Open-Begründungen |
| **Code Auditor** | Secure-Code-Review: Injection, Autorisierung, Secrets, Deserialisierung (Semgrep, CodeQL, gitleaks) |
| **Crypto Analyzer** | Schwache Algorithmen/Modi, Schlüssel- und IV-/Nonce-Handling, TLS-/Zertifikatskonfiguration, JWT-/JWE-Token-Probleme |
| **Traffic Analyzer** | Offline-Pcap-Analyse: Protokoll-Dissection, Extraktion von Anmeldedaten, Beacon-/Anomalie-Suche |

### Reporting und Lernen

| Agent | Was er tut |
|-------|-------------|
| **Report Generator** | Professionelle Pentest-Berichte mit Executive Summaries, CVSS-Bewertung, Sanierungs-Roadmaps |
| **CTF Solver** | HackTheBox, TryHackMe, PicoCTF. Web, Pwn, Rev, Crypto, Forensik, OSINT |
| **Compliance Mapper** | Ordnet Befunde PCI DSS, NIST 800-53/CSF, ISO 27001, CIS, HIPAA, SOC 2 zu, mit Control-Gap-Analyse |
| **Risk Scorer** | CVSS-3.1/4.0-Vektoren, EPSS- + CISA-KEV-Anreicherung, priorisierte Sanierung im Geschäftskontext |

---

## Tier 1 vs. Tier 2

**Tier 1 (alle Agents):** Beratungsmodus. Du fügst Tool-Ausgaben ein, stellst Methodikfragen und erhältst Analysen und Empfehlungen. Die Tools führst du selbst aus.

**Tier 2 (ausgewählte Agents):** Können auch direkt Befehle zusammenstellen und ausführen. Du legst deinen autorisierten Scope fest, der Agent validiert jedes Ziel dagegen, und Claude Code zeigt dir jeden Befehl vor der Ausführung zur Genehmigung.

| Tier-2-Agent | Was er ausführt |
|-------|-----------------|
| **Recon Advisor** | nmap, dig, whois, curl, netcat, traceroute, whatweb, nikto |
| **Vuln Scanner** | nuclei, nikto, nmap-NSE-Skripte |
| **Web Hunter** | ffuf, gobuster, feroxbuster, sqlmap, dalfox, whatweb |
| **AD Attacker** | BloodHound, Impacket, CrackMapExec, Certipy, ldapsearch, enum4linux |
| **Exploit Chainer** | Ausführung mehrstufiger Ketten mit Genehmigung an jedem Gate |
| **PoC Validator** | Sichere, nicht-destruktive Proof-of-Concept-Skripte |
| **Business Logic Hunter** | Tests auf Logikfehler (Preismanipulation, Race Conditions) |
| **AI Recon** | Erkennung von KI-Endpunkten, /v1/models-Probes, A2A/MCP-Enumeration (schreibgeschützt) |
| **Database Attacker** | sqlmap, NoSQLMap, native DB-Clients (beweisbegrenzt, nicht-destruktiv) |
| **Network Attacker** | Responder, ntlmrelayx, mitm6, bettercap (begrenztes L2/L3-Positioning) |
| **CI/CD Red Team** | Pipeline-gesteuerte SAST-/DAST-/Secret-Scans gegen Ziele im Scope |

Das vollständige Sicherheitsmodell findest du unter [docs/TIER2-EXECUTION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md).

---

## Beispiele```
$ claude

You: Analyze this Nmap scan and prioritize targets for our internal pentest

> Routing to recon-advisor agent...

## Prioritized Target Summary

### Critical Priority
| Host       | Port | Service | Finding                  |
|------------|------|---------|--------------------------|
| 10.10.1.5  | 445  | SMB     | SMBv1 enabled, MS17-010  |
| 10.10.1.20 | 3389 | RDP     | BlueKeep (CVE-2019-0708) |

### Recommended Next Steps
1. nmap -sV --script smb-vuln* 10.10.1.5
2. crackmapexec smb 10.10.1.0/24
3. bloodhound-python -d corp.local

More examples in the examples/ directory:


Tools in einem Container ausführen

Führen Sie Ihre Sicherheitstools in einem Docker-Container aus, um Ihren Arbeitsplatz sauber zu halten und Flags der Endpoint-Protection zu vermeiden.```bash docker pull kalilinux/kali-rolling docker run -it --name pentest-lab kalilinux/kali-rolling /bin/bash apt update && apt install -y nmap nikto sqlmap metasploit-framework bloodhound

root@kitploit:~
Nutzen Sie pentest-ai-Agenten auf Ihrem Host für Methodik und Analyse. Führen Sie die eigentlichen Tools im Container aus.

---

## Findings-Datenbank

Persistenter SQLite-Speicher, der Engagement-Daten über Claude-Code-Sitzungen hinweg aufbewahrt.```bash
findings.sh init acme-2024 --client "ACME Corp" --type internal --scope "10.0.0.0/24"
export PENTEST_AI_ENGAGEMENT="acme-2024"

findings.sh stats         # Check progress
findings.sh list vulns    # See all findings
findings.sh export        # Full JSON export
bash handoff.sh           # Markdown handoff report for next session

Tier-2-Agenten schreiben automatisch in die Datenbank, wenn findings.sh im PATH ist. Vollständige Dokumentation siehe docs/FINDINGS-DB.md.


Token-Optimierung

Installieren Sie mit dem Lite-Modus, um Advisory-Agenten auf Haiku auszuführen (geringere Kosten, gleiche Methodik):```bash ./install.sh --global --lite

root@kitploit:~
Siehe [docs/TOKEN-OPTIMIZATION.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) für die vollständige Anleitung.

---

## Lokale Modelle

Die Agents sind einfache Markdown-Systemprompts – der einzige Claude-spezifische Teil ist der YAML-Frontmatter-Header. Sie laufen auf jedem Modell: Richten Sie Claude Code über die Umgebungsvariable `ANTHROPIC_BASE_URL` auf einen beliebigen Anthropic-kompatiblen Endpunkt aus oder kopieren Sie den Systemprompt (alles unterhalb des Frontmatters) in einen beliebigen lokalen Runner wie Ollama oder LM Studio.

Siehe [docs/LOCAL-SETUP.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) für Hinweise zu lokalen Modellen.

---

## Dokumentation

| Dokument | Beschreibung |
|----------|-------------|
| [INSTALL.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/INSTALL.md) | Installationsanleitung mit Fehlerbehebung |
| [Agent Guide](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/AGENT-GUIDE.md) | Wie jeder Agent funktioniert und wann er verwendet wird |
| [Tier 2 Execution](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TIER2-EXECUTION.md) | Sicherheitsmodell des Ausführungsmodus und Konvertierungsanleitung |
| [Local Setup](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/LOCAL-SETUP.md) | Offline mit Ollama und lokaler GPU ausführen |
| [Customization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/CUSTOMIZATION.md) | Agents modifizieren, Modelle wechseln, neue Agents erstellen |
| [Token Optimization](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/TOKEN-OPTIMIZATION.md) | Token-Verbrauch reduzieren |
| [Findings Database](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/FINDINGS-DB.md) | Persistenter SQLite-Speicher für Engagement-Daten |
| [Data Privacy](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/docs/DATA-PRIVACY.md) | LLM-Datenverarbeitung und Optionen für lokale Modelle |
| [Changelog](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/CHANGELOG.md) | Versionsverlauf |

---

## MCP-Server

Auf der Suche nach der automatisierten Pipeline? **[pentest-ai](https://github.com/0xSteph/pentest-ai)** ist der begleitende MCP-Server mit 150+ Tool-Wrappern, autonomer Exploit-Verkettung und CI/CD-Integration. Funktioniert mit Claude Desktop, Cursor, VS Code Copilot und jedem MCP-Client.

---

## Voraussetzungen

- [Claude Code](https://docs.anthropic.com/en/docs/claude-code) installiert und konfiguriert
- Claude Pro- oder Max-Abonnement
- Für Sicherheitstests: unterzeichnete Regeln für den Einsatz und definierter Umfang

---

## Rechtliches

Dieses Toolkit ist **ausschließlich für autorisierte Sicherheitstests** bestimmt. Benutzer müssen vor der Verwendung dieser Agents in einem Einsatz über eine ordnungsgemäße schriftliche Genehmigung verfügen. Die vollständigen Bedingungen finden Sie in [DISCLAIMER.md](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/DISCLAIMER.md).

---

## Lizenz

[MIT License](https://github.com/0xsteph/pentest-ai-agents/blob/HEAD/LICENSE)

---

<div align="center">

Erstellt von [0xSteph](https://github.com/0xSteph) &middot; [pentestai.xyz](https://pentestai.xyz)

</div>
Tool herunterladen
persistence-planner
data-exfiltrator
scada-attacker
iot-pentester
lateral-movement
  • Gehärteter CI-Validator. Ein SHA-pinnender Workflow mit minimalen Rechten validiert das Frontmatter jedes Agents, verlangt den Scope-Guard-Block bei jedem Bash-fähigen (Tier 2) Agenten, prüft die Plugin-Manifeste und testet den Installer per Smoke-Test.
  • Scope-Guard-Lücke geschlossen. cicd-redteam ist Bash-fähig, aber es fehlte der obligatorische Scope-Enforcement-Block – jetzt behoben (die neue CI-Prüfung hätte es erkannt).
  • Installer-Fixes. curl | bash stürzt unter set -u nicht mehr ab, die Clone-URL für den Einzeiler wurde korrigiert, Slash-Befehle werden jetzt zusammen mit den Agenten installiert und --uninstall entfernt alles sauber.
  • Minimales Offline-Docker-Bundle mit einer per Digest gepinnten Basis und Nicht-Root-Benutzer – nur Paketierung, keine enthaltenen Tools.
  • BefehlFunktion
    /recommend "phish a small SaaS team's IT department"Wählt den richtigen Agenten aus und gibt konkrete nächste Befehle aus
    /agents-for webListet alle Agenten auf, die für Webtests relevant sind (web-hunter, api-security, bug-bounty, bizlogic-hunter)
    /agents-for cloudCloud-spezifische Agenten (cloud-security, cicd-redteam)
    db/doctor.shPrüft, welche zugrunde liegenden CLI-Tools du hast, gruppiert nach Agent. Zeigt ✔/✘ und Installationshinweise.
    db/doctor.sh --agent ad-attackerPrüft nur den AD-Tooling-Stack
    db/doctor.sh --jsonMaschinenlesbare Ausgabe zum Weiterleiten in ein Skript
    install.sh --toolsInstalliert die zugrunde liegenden Tools über deinen Paketmanager + pipx/go/cargo
    findings.sh init <id>Startet ein neues Engagement (persistente SQLite-Findings-DB)
    findings.sh statsEngagement-Fortschritt
    findings.sh exportVollständiger JSON-Export
    bash handoff.shMarkdown-Übergabebericht zwischen Sitzungen
    BeispielAgentWas es zeigt
    Engagement-Planengagement-plannerVollständiger phasenbasierter Plan mit MITRE-ATT&CK-Zuordnungen
    Nmap-Analyserecon-advisorPriorisierte Angriffsvektoren mit Folge-Befehlen
    Erkennungsregeldetection-engineerKerberoasting-Erkennung in Sigma, SPL und KQL
    STIG-Befundstig-analystSTIG-Analyse mit GPO-Pfad und Keep-Open-Vorlage
    Berichtsauszugreport-generatorSQL-Injection-Befund formatiert für einen Pentest-Bericht