Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
pdfgrab — Tool zum Durchsuchen von PDFs in Google und Extrahieren von PDF-Metadaten | Kitploit
Tools/GitHubGitHub/c0decave/pdfgrab
OSINT (Open-Source-Intelligence)AufklärungSchwachstellenanalyseInformationsbeschaffungDigitale Forensik
GitHubc0decave/pdfgrab

pdfgrab

Tool zum Durchsuchen von PDFs in Google und Extrahieren von PDF-Metadaten

Repository anzeigen
31vor 6 JahrenNoch nicht geprüft

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
Teilen

pdfgrab

  • Version 0.4.9

Was ist das?

Dies ist ein wiederbelebtes Tool aus der Epoche, in der Dinosaurier über die Erde stapften. Grundsätzlich analysiert es PDF-Dateien auf Metadaten. Du kannst es auf eine Datei oder ein Verzeichnis mit PDFs richten. Du kannst ihm die URL einer PDF zeigen oder die integrierte Google-Suche nutzen (Dank an die Klasse von Mario Vilas), um auf der Zielseite nach PDFs zu suchen, sie herunterzuladen und zu analysieren.

Was ist neu in 0.4.9?

  • Reporting-Methoden in libreport.py exportiert
  • optargs hinzugefügt, um verschiedene Report-Methoden zu deaktivieren
  • den HTML-Report etwas aufgehübscht
  • Funktion zum Generieren des HTML-Reports nach der Analyse hinzugefügt
  • requests und Datenspeicherung in eine neue Bibliothek exportiert
  • Code-Fixes und klarere Fehlerbehandlung
  • nicht mehr benötigten site:-Parameter beim Such-Flag -s entfernt
  • README aktualisiert
  • -s-Flag akzeptiert jetzt mehrere Domains
  • Konsolen-Logging sauberer

Welche Informationen können gesammelt werden?

Das hängt von der Software ab, die zum Erstellen der PDF verwendet wurde. Und davon, ob sie bereinigt wurde. Üblich sind jedoch die folgenden Dinge:

  • Producer
  • Creator
  • CreationDate
  • ModificationDate
  • Author
  • Title
  • Subject

und einiges mehr :)

Wofür ist das überhaupt gut?

Nun, das kann für eine Reihe von Dingen verwendet werden. Ich werde mich jedoch nur auf den Sicherheitsaspekt konzentrieren. Abhängig von deinem Ziel erhältst du Informationen über:

  • verwendete Software in Firma xyz
    • mögliche Versionsnummern
      • das hilft dir, vorhandene Schwachstellen zu identifizieren
    • manchmal werden PDFs neu gerendert, zum Beispiel bei Uploads
      • dann kannst du herausfinden, welche Rendering-Engine verwendet wird, und darin Fehler finden
  • wer der Autor von Dokumenten ist
    • manchmal sind Benutzernamen Benutzer des Betriebssystems selbst
      • Glückwunsch, du hast durch die Analyse einer PDF gerade einen vorhandenen Benutzernamen in der Domäne gefunden
      • kombiniere die Informationen mit dem ersten Teil, dann weißt du, welcher Benutzer welche Software verwendet
  • Passwörter ... muss ich mehr sagen?

Ist es unfehlbar?

Überhaupt nicht. Bitte beachte, dass Metadaten wie alle anderen Daten einfach in die Datei geschrieben werden. Sie können also geändert werden, bevor sie hochgeladen wird. Abgesehen davon liegt der Anteil der Unternehmen, die solche Daten tatsächlich ändern, vielleicht bei 20 %. Außerdem erkennst du, wenn sie leer sind oder Ähnliches.

Wie funktioniert es?

Jeder komplexere Dateityp jenseits von .txt oder Ähnlichem nutzt Metadaten aus Bequemlichkeit, für den Kundensupport oder nur, um zu verbreiten, dass er verwendet wurde. Im Internet gibt es viele Informationen über Metadaten in verschiedenen Dateitypen wie Bildern, Dokumenten, Videos und Musik. Dieses Tool konzentriert sich ausschließlich auf PDFs. Wenn dir dieser Begriff neu ist, wirf einen Blick hierauf:

  • https://en.wikipedia.org/wiki/Metadata

Wenn du an einer echten PDF-Analyse interessiert bist, erledigt dieses Tool nur die Grundlagen für dich. Es wurde nicht geschrieben, um bösartige Dateien, Malware oder auch nur interessante Dateien zu analysieren. Sein Zweck ist es, dir eine Vorstellung davon zu geben, was beim Ziel xyz verwendet wird. Wenn du nach einer tiefergehenden Analyse suchst, empfehle ich die Tools von Didier Stevens:

  • https://blog.didierstevens.com/programs/pdf-tools/

Download

root@kitploit:~
git clone https://github.com/c0decave/pdfgrab
cd pdfgrab
python3 pdfgrab.py -h

Verwendung

Das sind deine wichtigsten Optionen:

  • PDF von URL holen und analysieren
  • Website über Google nach PDFs durchsuchen, holen und analysieren
  • lokale PDF analysieren
  • lokales Verzeichnis mit PDFs analysieren

Einzel-URL-Modus

root@kitploit:~
# ./pdfgrab.py -u https://www.kernel.org/doc/mirror/ols2004v2.pdf

Ergebnis:

root@kitploit:~
[+] Grabbing https://www.kernel.org/doc/mirror/ols2004v2.pdf
[+] Written 3893173 bytes for File: pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

Einzeldatei-Modus

root@kitploit:~
# ./pdfgrab.py -f pdfgrab/ols2004v2.pdf 

Ergebnis:

root@kitploit:~
[+] Parsing pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

Verzeichnis-Modus

root@kitploit:~
./pdfgrab.py -F pdfgrab/

Analysiert alle PDFs in diesem Verzeichnis

Google-Suchmodus

root@kitploit:~
# ./pdfgrab.py -s kernel.org

Ergebnis:

root@kitploit:~
[+] Seek and analysing site:kernel.org
http://vger.kernel.org/lpc_bpf2018_talks/bpf_global_data_and_static_keys.pdf
http://vger.kernel.org/netconf2018_files/JiriPirko_netconf2018.pdf
http://vger.kernel.org/netconf2018_files/PaoloAbeni_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/LPC_XDP_Shirokov_paper_v1.pdf
http://vger.kernel.org/netconf2018_files/FlorianFainelli_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/tc_sw_paper.pdf
https://www.kernel.org/doc/mirror/ols2009.pdf
https://www.kernel.org/doc/mirror/ols2004v2.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf_paper.pdf

[+] Written 211391 bytes for File: pdfgrab/bpf_global_data_and_static_keys.pdf
[+] Opening pdfgrab/bpf_global_data_and_static_keys.pdf
--------------------------------------------------------------------------------
File: pdfgrab/bpf_global_data_and_static_keys.pdf
/Author 
/Title 
/Subject 
/Creator LaTeX with Beamer class version 3.36
/Producer pdfTeX-1.40.17
/Keywords 
/CreationDate D:20181102231821+01'00'
/ModDate D:20181102231821+01'00'
/Trapped /False
/PTEX.Fullbanner This is pdfTeX, Version 3.14159265-2.6-1.40.17 (TeX Live 2016) kpathsea version 6.2.2

Google-Suchmodus, mehrere Domains

root@kitploit:~
# ./pdfgrab.py -s example.com,example.us

Berichterstellung

pdfgrab gibt die Informationen in verschiedenen Formaten aus. Wenn nicht durch eines der Reporting-Flags deaktiviert (siehe -h), findest du im Ausgabeverzeichnis:

  • HTML-Report
  • Text-Report
  • Text-URL-Liste
  • JSON-Daten
  • JSON-URL-Liste

Protokollierung

pdfgrab erstellt im Arbeitsverzeichnis eine Logdatei namens „pdfgrab.log“.

Google

  • Suche: filetype:pdf site:com
  • Ergebnisse: 264.000.000

Haftungsausschluss

Viel Spaß!

Tool herunterladen