
गूगल के भीतर पीडीएफ़ खोजने और पीडीएफ़ मेटाडेटा निकालने का उपकरण
यह एक पुनर्जन्मित उपकरण है, जिसका उपयोग उस युग में किया जाता था जब डायनासोर पृथ्वी पर विचरण कर रहे थे। मूल रूप से यह PDF फ़ाइलों का मेटाडेटा के लिए विश्लेषण करता है। आप इसे pdf वाली फ़ाइल या निर्देशिका पर ले जा सकते हैं। आप इसे किसी pdf का URL दिखा सकते हैं या लक्ष्य साइट पर pdf खोजने, डाउनलोड करने और उनका विश्लेषण करने के लिए एकीकृत googlesearch (mario vilas class को धन्यवाद) का उपयोग कर सकते हैं।
यह pdf बनाने के लिए उपयोग किए गए सॉफ़्टवेयर पर निर्भर करता है। और इस पर भी कि इसे साफ किया गया है या नहीं। हालांकि, सामान्यतः निम्नलिखित चीज़ें पाई जाती हैं:
और कुछ और :)
खैर, इसका उपयोग कई चीज़ों के लिए किया जा सकता है। हालांकि, मैं इसके केवल सुरक्षा पहलू पर ध्यान केंद्रित करूँगा। आपके लक्ष्य के आधार पर आपको निम्नलिखित के बारे में जानकारी मिलेगी:
बिल्कुल नहीं। कृपया ध्यान दें कि मेटाडेटा, अन्य सभी डेटा की तरह, केवल उस फ़ाइल में लिखा जाता है। इसलिए इसे अपलोड करने से पहले बदला जा सकता है। फिर भी, वास्तव में उस तरह के डेटा को बदलने वाली कंपनियों की संख्या शायद 20% है। साथ ही, यदि यह खाली या ऐसा ही है, तो आप इसे पहचान लेंगे।
हर अधिक जटिल फ़ाइल प्रकार, जो .txt या इसी तरह से ऊपर है, सुविधा, ग्राहक सहायता या केवल यह फैलाने के लिए कि इसका उपयोग किया गया है, मेटाडेटा का उपयोग करता है। चित्रों, दस्तावेज़ों, वीडियो, संगीत जैसी विभिन्न प्रकार की फ़ाइलों के मेटाडेटा के बारे में ऑनलाइन बहुत सारी जानकारी उपलब्ध है। यह उपकरण केवल pdf पर केंद्रित है। यदि आप इस शब्द से अपरिचित हैं, तो यहाँ देखें:
इसके अलावा, यदि आप वास्तविक pdf विश्लेषण में रुचि रखते हैं, तो यह उपकरण आपके लिए केवल मूल बातें करेगा। इसे दुर्भावनापूर्ण, मैलवेयर या यहाँ तक कि दिलचस्प फ़ाइलों का विश्लेषण करने के लिए नहीं लिखा गया है। इसका उद्देश्य आपको यह अंदाज़ा देना है कि लक्ष्य xyz पर क्या उपयोग हो रहा है। यदि आप अधिक गहन विश्लेषण की तलाश में हैं, तो मैं Didier Stevens के उपकरणों की अनुशंसा करता हूँ:
git clone https://github.com/c0decave/pdfgrab
cd pdfgrab
python3 pdfgrab.py -h
ये आपके मुख्य विकल्प हैं:
# ./pdfgrab.py -u https://www.kernel.org/doc/mirror/ols2004v2.pdf
परिणाम:
[+] Grabbing https://www.kernel.org/doc/mirror/ols2004v2.pdf
[+] Written 3893173 bytes for File: pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------
# ./pdfgrab.py -f pdfgrab/ols2004v2.pdf
परिणाम:
[+] Parsing pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------
./pdfgrab.py -F pdfgrab/
उस निर्देशिका में सभी pdf का विश्लेषण करेगा
# ./pdfgrab.py -s kernel.org
परिणाम:
[+] Seek and analysing site:kernel.org
http://vger.kernel.org/lpc_bpf2018_talks/bpf_global_data_and_static_keys.pdf
http://vger.kernel.org/netconf2018_files/JiriPirko_netconf2018.pdf
http://vger.kernel.org/netconf2018_files/PaoloAbeni_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/LPC_XDP_Shirokov_paper_v1.pdf
http://vger.kernel.org/netconf2018_files/FlorianFainelli_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/tc_sw_paper.pdf
https://www.kernel.org/doc/mirror/ols2009.pdf
https://www.kernel.org/doc/mirror/ols2004v2.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf_paper.pdf
[+] Written 211391 bytes for File: pdfgrab/bpf_global_data_and_static_keys.pdf
[+] Opening pdfgrab/bpf_global_data_and_static_keys.pdf
--------------------------------------------------------------------------------
File: pdfgrab/bpf_global_data_and_static_keys.pdf
/Author
/Title
/Subject
/Creator LaTeX with Beamer class version 3.36
/Producer pdfTeX-1.40.17
/Keywords
/CreationDate D:20181102231821+01'00'
/ModDate D:20181102231821+01'00'
/Trapped /False
/PTEX.Fullbanner This is pdfTeX, Version 3.14159265-2.6-1.40.17 (TeX Live 2016) kpathsea version 6.2.2
# ./pdfgrab.py -s example.com,example.us
pdfgrab जानकारी को विभिन्न प्रारूपों में आउटपुट करता है। यदि इसे किसी रिपोर्टिंग फ़्लैग (देखें -h) द्वारा अक्षम नहीं किया गया है, तो आपको आउटपुट निर्देशिका में मिलेगा:
pdfgrab चालू निर्देशिका में "pdfgrab.log" नामक एक लॉगफ़ाइल बनाता है।
मज़ा लीजिए!