
Strumento per cercare PDF su Google ed estrarre i metadati dei PDF.
Questo è uno strumento rinato, usato durante l'epoca in cui i dinosauri vagavano sulla terra. Fondamentalmente analizza i file PDF per cercare metadati. Puoi puntarlo a un file o a una directory con PDF. Puoi passargli l'URL di un PDF o usare la ricerca Google integrata (grazie alla classe di mario vilas) per cercare PDF nel sito target, scaricarli e analizzarli.
Dipende dal software usato per creare il PDF e dal fatto che sia stato ripulito o meno. Tuttavia, gli elementi comuni sono i seguenti:
e qualche altro :)
Beh, può essere usato per una serie di cose. Tuttavia, mi concentrerò solo sulla parte relativa alla sicurezza. A seconda del tuo target otterrai informazioni su:
Per niente. Tieni presente che i metadati, come qualsiasi altro dato, sono semplicemente scritti nel file. Quindi possono essere modificati prima del caricamento. Detto questo, la percentuale di aziende che modificano davvero questo tipo di dati è forse del 20%. Inoltre, potrai capire se è vuoto o simile.
Ogni tipo di file più complesso di .txt o simili usa i metadati per comodità, supporto clienti o solo per diffondere che è stato usato. Online ci sono molte informazioni sui metadati in diversi tipi di file come immagini, documenti, video, musica. Questo strumento si concentra solo sui PDF. Se non conosci questo termine, dai un'occhiata qui:
Inoltre, se sei interessato a una vera analisi dei PDF, questo strumento farà solo le basi per te. Non è stato scritto per analizzare file dannosi, malware o comunque interessanti. Il suo scopo è darti un'idea di cosa viene usato nel target xyz. Se cerchi un'analisi più approfondita, consiglio gli strumenti di Didier Stevens:
git clone https://github.com/c0decave/pdfgrab
cd pdfgrab
python3 pdfgrab.py -h
Queste sono le opzioni principali:
# ./pdfgrab.py -u https://www.kernel.org/doc/mirror/ols2004v2.pdf
Risultato:
[+] Grabbing https://www.kernel.org/doc/mirror/ols2004v2.pdf
[+] Written 3893173 bytes for File: pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------
# ./pdfgrab.py -f pdfgrab/ols2004v2.pdf
Risultato:
[+] Parsing pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------
./pdfgrab.py -F pdfgrab/
Analizzerà tutti i PDF in quella directory
# ./pdfgrab.py -s kernel.org
Risultato:
[+] Seek and analysing site:kernel.org
http://vger.kernel.org/lpc_bpf2018_talks/bpf_global_data_and_static_keys.pdf
http://vger.kernel.org/netconf2018_files/JiriPirko_netconf2018.pdf
http://vger.kernel.org/netconf2018_files/PaoloAbeni_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/LPC_XDP_Shirokov_paper_v1.pdf
http://vger.kernel.org/netconf2018_files/FlorianFainelli_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/tc_sw_paper.pdf
https://www.kernel.org/doc/mirror/ols2009.pdf
https://www.kernel.org/doc/mirror/ols2004v2.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf_paper.pdf
[+] Written 211391 bytes for File: pdfgrab/bpf_global_data_and_static_keys.pdf
[+] Opening pdfgrab/bpf_global_data_and_static_keys.pdf
--------------------------------------------------------------------------------
File: pdfgrab/bpf_global_data_and_static_keys.pdf
/Author
/Title
/Subject
/Creator LaTeX with Beamer class version 3.36
/Producer pdfTeX-1.40.17
/Keywords
/CreationDate D:20181102231821+01'00'
/ModDate D:20181102231821+01'00'
/Trapped /False
/PTEX.Fullbanner This is pdfTeX, Version 3.14159265-2.6-1.40.17 (TeX Live 2016) kpathsea version 6.2.2
# ./pdfgrab.py -s example.com,example.us
pdfgrab restituisce le informazioni in diversi formati. Se non viene disabilitato da uno dei flag di reporting (vedi -h), nella directory di output troverai:
pdfgrab crea un file di log nella directory corrente chiamato "pdfgrab.log"
Divertiti!