Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
PentestGPT — Automatisiertes Penetrationstest-Agenten-Framework basierend auf Großen Sprachmodellen | Kitploit
Tools/GitHubGitHub/greydgl/pentestgpt
Penetrationstest-FrameworksAufklärungSchwachstellenscannerExploit-FrameworksCTFPenetrationstestsPapers & ForschungLernen & BildungKI-Sicherheit
GitHubgreydgl/pentestgpt

PentestGPT

Automatisiertes Penetrationstest-Agenten-Framework basierend auf Großen Sprachmodellen

14.8k2.6kvor 1 MonatVon Kitploit geprüft

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
Teilen
Repository anzeigen

Contributors Forks Stargazers Issues MIT License Discord


PentestGPT

KI-gestützter autonomer Penetrationstest-Agent
Veröffentlicht auf der USENIX Security 2024

Offizielle Website: pentestgpt.com »

Forschungspapier · Fehler melden · Funktion anfragen

GreyDGL%2FPentestGPT | Trendshift


Demo

Installation

Installations-Demo

Auf YouTube ansehen

PentestGPT in Aktion

PentestGPT-Demo

Auf YouTube ansehen


Neuerungen in v1.0 (Agentisches Upgrade)

  • Mehrstufige Pipeline – Der Agent arbeitet in gestaffelten Phasen (Recon → Exploit → Walkthrough für CTF; Asset-Erkennung → Schwachstellenidentifizierung → Bericht für Pentests) und übergibt die Ergebnisse jeder Stufe an die nächste.
  • Autonomer Agent – Steuert Claude Code oder Codex, um Tools auszuführen und ohne menschliches Eingreifen zu argumentieren.
  • Sitzungspersistenz – Penetrationstest-Sitzungen speichern und fortsetzen.

Die autonome CTF-Pipeline ist backend-plugbar für Claude Code und Codex. Der interaktive modernisierte Legacy-Modus (pentestgpt-legacy) unterstützt einen breiteren Anbieter-Set: OpenAI, Anthropic, Google Gemini, DeepSeek, xAI, Qwen, Moonshot und lokales Ollama. Siehe Interaktiver Multi-LLM-Modus.


Funktionen

  • KI-gestützter Herausforderungslöser – Nutzt fortgeschrittenes Reasoning von LLMs zur Durchführung von Penetrationstests und CTFs.
  • Live-Walkthrough – Verfolgt die Schritte in Echtzeit, während der Agent die Herausforderungen bearbeitet.
  • Multi-Kategorie-Unterstützung – Web, Crypto, Reversing, Forensik, PWN, Privilege Escalation.
  • Echtzeit-Feedback – Beobachten Sie die KI mit Live-Aktualisierungen bei der Arbeit.
  • Erweiterbare Architektur – Sauberes, modulares Design für zukünftige Erweiterungen.

Schnellstart

Voraussetzungen

  • Python 3.12+
  • uv – Python-Paketmanager
  • Claude Code CLI (claude) – installiert und authentifiziert für lokale Claude-Ausführungen. Siehe Claude Code-Dokumentation.
  • Codex CLI (codex) – installiert und authentifiziert für lokale Codex-Ausführungen. Der Docker-Workflow unten bündelt beide CLIs.

Installation

root@kitploit:~
git clone https://github.com/GreyDGL/PentestGPT.git
cd PentestGPT
make install    # führt uv sync aus

Befehlsreferenz

BefehlBeschreibung
make installAbhängigkeiten installieren
make testAlle Tests ausführen

Verwendung

root@kitploit:~
# Gegen ein Ziel (Standardmäßig CTF-Modus)
pentestgpt --target 10.10.11.234

# Mit Challenge-Kontext
pentestgpt --target 10.10.11.50 --instruction "WordPress-Site, fokussiere dich auf Plugin-Schwachstellen"

# Penetrationstest-Modus (Asset-Erkennung → Schwachstellen → Bericht)
pentestgpt --target 10.10.11.234 --mode pentest

# Zuvor gespeicherte Sitzungen auflisten
pentestgpt --list-sessions

Der Agent arbeitet mit einer mehrstufigen Pipeline, die die Ergebnisse jeder Stufe an die nächste weitergibt – Erkundung → Ausnutzung → Walkthrough für CTF, Asset-Erkennung → Schwachstellenidentifizierung → Bericht für Pentests.

In Docker ausführen (einmal installieren, einmal anmelden)

Ein eigenständiges Image bündelt das Tool sowie die CLIs von Claude Code und Codex. Sie melden sich einmal an und die Sitzungen bleiben in benannten Volumes erhalten – kein erneutes Anmelden bei späteren Läufen.

root@kitploit:~
make docker-build        # Tool-Image bauen
make docker-login        # EINMALIG, idempotent: prüft Anmeldungen, meldet nur fehlende an
make docker-auth-status  # Überprüft, ob beide angemeldet sind (ROUNDTRIP=1 für Live-1-Token-Prüfung)

# Pipeline gegen ein Ziel ausführen (beliebiges Backend/Modell/Mode):
make docker-run TARGET=http://127.0.0.1:8000 BACKEND=codex MODEL=gpt-5.5 MODE=ctf
make docker-run TARGET=10.10.11.234         BACKEND=claude MODEL=opus    MODE=pentest

make docker-login meldet Claude an (setup-token → Token im Volume gespeichert) und Codex (eigenes codex login innerhalb des Containers, OAuth-Callback über socat weitergeleitet – nicht gesied, da ChatGPT-Refresh-Tokens nur einmal verwendbar sind). Es ist idempotent: Bei erneuter Ausführung wird übersprungen, was noch gültig ist. Anmeldungen bleiben über Container-Neuerstellung hinweg erhalten; make docker-down bewahrt sie, make docker-nuke entfernt die Anmelde-Volumes (um eine frische Anmeldung zu erzwingen / ein Token zu rotieren). Design + Details: docs/docker-dev-plan.md.


Interaktiver Multi-LLM-Modus (modernisierter Legacy)

Der klassische PentestGPT mit Mensch-in-der-Schleife aus dem USENIX-2024-Papier ist erhalten und als pentestgpt-legacy modernisiert. Er führt drei zusammenarbeitende LLM-Sitzungen aus – Reasoning / Generierung / Parsing – die einen Pentesting Task Tree (PTT) verwalten, während Sie die Sitzung interaktiv steuern (next, more, todo, discuss). Die autonome Pipeline mit festen Stufen unterstützt Claude- und Codex-Backends; dieser Legacy-Modus spricht nativ mit vielen Anbietern über deren offizielle SDKs.

Anbieter konfigurieren

Setzen Sie einen API-Schlüssel für jeden Anbieter, den Sie verwenden möchten (in Ihrer Umgebung oder .env – siehe .env.example). Nur die konfigurierten Anbieter sind aktiviert.

root@kitploit:~
OPENAI_API_KEY=...        ANTHROPIC_API_KEY=...     GEMINI_API_KEY=...   # oder GOOGLE_API_KEY
DEEPSEEK_API_KEY=...      GROK_API_KEY=...          QWEN_API_KEY=...     KIMI_API_KEY=...

Ausführen

root@kitploit:~
# Automatisch die besten verfügbaren Modelle für jede Sitzung auswählen
pentestgpt-legacy

# Modelle pro Sitzung auswählen
pentestgpt-legacy --reasoning-model claude-opus-4-8 --parsing-model gemini-3.5-flash

# Lokales Modell über Ollama (OpenAI-kompatibel)
pentestgpt-legacy --reasoning-model ollama:qwen3 --base-url http://localhost:11434/v1

# Alle unterstützten Modelle auflisten (zeigt, welche Anbieter konfiguriert sind)
pentestgpt-legacy --list-models

# Live-Roundtrip jedes konfigurierten Modells und Ausgabe einer Bestanden/Nicht bestanden-Matrix
pentestgpt-legacy --smoke-test

Unterstützte Modelle (webverifiziert Juni 2026)

pentestgpt-legacy --list-models rendert stets das Live-Register. Führen Sie --smoke-test nach Änderungen der Modell-IDs erneut aus. Aktueller Stand:

Das Register befindet sich in pentestgpt_legacy/llm/registry.py (der einzigen Quelle der Wahrheit). Das Hinzufügen eines Modells ist ein ModelSpec-Eintrag; OpenAI-kompatible Anbieter verwenden einen Connector wieder.


Telemetrie

PentestGPT sammelt anonyme Nutzungsdaten, um das Tool zu verbessern. Diese Daten werden an unser Langfuse-Projekt gesendet und umfassen:

  • Sitzungsmetadaten (Zieltyp, Dauer, Abschlussstatus)
  • Tool-Ausführungsmuster (welche Tools verwendet werden, nicht die eigentlichen Befehle)
  • Flag-Erkennungsereignisse (dass ein Flag gefunden wurde, nicht der Flag-Inhalt)

Es werden keine sensiblen Daten gesammelt – Befehlsausgaben, Anmeldedaten oder tatsächliche Flag-Werte werden nie übertragen.

Deaktivieren

root@kitploit:~
# Über die Befehlszeilenoption
pentestgpt --target 10.10.11.234 --no-telemetry

# Über die Umgebungsvariable
export LANGFUSE_ENABLED=false

Benchmark-Historie

PentestGPT erreichte eine Erfolgsrate von 86,5 % (90/104 Benchmarks) in einem XBOW-Validierungssuite-Experiment im Dezember 2025. Diese Zahl ist ein historisches Forschungsergebnis, keine aktuelle pentestgpt-agent-Regressionsgarantie.

XBOW-Harness- und Ergebnisarchive werden außerhalb dieses Produkt-Repositorys als reine Referenz-Forschungsartefakte gepflegt. Die unterstützte PentestGPT-CLI, Makefile, CI und Docker-Laufzeitumgebung legen keinen XBOW-Runner frei. Eine zukünftige Evaluierung könnte dieses Korpus über einen separat verwalteten Adapter wiederverwenden, ohne es zu einer Produktabhängigkeit zu machen.


Zitierung

Wenn Sie PentestGPT in Ihrer Forschung verwenden, zitieren Sie bitte unser Papier:

root@kitploit:~
@inproceedings{299699,
  author = {Gelei Deng and Yi Liu and Víctor Mayoral-Vilches and Peng Liu and Yuekang Li and Yuan Xu and Tianwei Zhang and Yang Liu and Martin Pinzger and Stefan Rass},
  title = {{PentestGPT}: Evaluating and Harnessing Large Language Models for Automated Penetration Testing},
  booktitle = {33rd USENIX Security Symposium (USENIX Security 24)},
  year = {2024},
  isbn = {978-1-939133-44-1},
  address = {Philadelphia, PA},
  pages = {847--864},
  url = {https://www.usenix.org/conference/usenixsecurity24/presentation/deng},
  publisher = {USENIX Association},
  month = aug
}

Lizenz

Verteilt unter der MIT-Lizenz. Siehe LICENSE.md für weitere Informationen.

Haftungsausschluss: Dieses Tool ist nur für Bildungszwecke und autorisierte Sicherheitstests bestimmt. Die Autoren befürworten keine illegale Nutzung. Nutzung auf eigene Gefahr.


Danksagungen

  • Forschung unterstützt von Quantstamp und der NTU Singapur

(Zurück nach oben)

Tool herunterladen
make check
Linting + Typenprüfung ausführen
make buildVerteilbares Paket bauen
AnbieterAktuelle ModelleLegacy (behalten)Umgebungsvariable
OpenAIgpt-5.5, gpt-5.5-pro, gpt-5.4-mini, gpt-5.4-nano, gpt-5.2, gpt-5.3-codexgpt-4o, gpt-4o-mini, o3, o4-miniOPENAI_API_KEY
Anthropicclaude-opus-4-8, claude-sonnet-4-6, claude-haiku-4-5-20251001—ANTHROPIC_API_KEY
Google Geminigemini-3.1-pro, gemini-3.5-flash, gemini-3-pro, gemini-3.1-flash-litegemini-2.5-pro, gemini-2.5-flashGEMINI_API_KEY / GOOGLE_API_KEY
DeepSeekdeepseek-v4-flash, deepseek-v4-prodeepseek-chat, deepseek-reasonerDEEPSEEK_API_KEY
xAI Grokgrok-4.3—GROK_API_KEY / XAI_API_KEY
Alibaba Qwenqwen3.7-max, qwen3.5-flashqwen3-maxQWEN_API_KEY / DASHSCOPE_API_KEY
Moonshot Kimikimi-k2.6—KIMI_API_KEY (.cn-Standard; setzen Sie MOONSHOT_BASE_URL für .ai)
Lokal (Ollama)ollama:<model> (z.B. ollama:qwen3)—keine (OLLAMA_BASE_URL)