
LeakScraper क्रेडेंशियल्स वाली विशाल टेक्स्ट फाइलों को प्रोसेस और विज़ुअलाइज़ करने के लिए एक कुशल टूल्स का सेट है। ये टूल्स पेनिट्रेशन टेस्टर्स और रेडटीमर्स को उनके लक्ष्य से संबंधित क्रेडेंशियल्स एकत्र करके OSINT करने में मदद करने के लिए डिज़ाइन किए गए हैं।
LeakScraper विशाल टेक्स्ट फ़ाइलों को संसाधित करने और विज़ुअलाइज़ करने के लिए उपकरणों का एक कुशल सेट है जिसमें क्रेडेंशियल्स होते हैं। ये उपकरण पेंटेस्टर्स/रेडटीमर्स को OSINT, क्रेडेंशियल्स गैदरिंग और क्रेडेंशियल्स स्टफिंग हमलों में मदद करने के लिए डिज़ाइन किए गए हैं।
git clone -b mongodb https://github.com/Acceis/leakScraper
cd leakScraper
sudo ./install.sh
Linux (debian), python 3.x और एक mongodb सर्वर।
उसके लिए विकी देखें

LeakScraper तीन भागों में विभाजित है :
email:hash:plain ("plain" का अर्थ "प्लेन टेक्स्ट पासवर्ड")।कवर किया गया उपयोग मामला निम्नलिखित है : किसी विशिष्ट संगठन/कंपनी/संरचना से संबंधित क्रेडेंशियल्स खोजना। यह उस संगठन से संबंधित ईमेल से जुड़े क्रेडेंशियल्स को खोजकर किया जाता है। उदाहरण : माइक्रोसॉफ्ट से संबंधित क्रेडेंशियल्स खोजना, उन खातों से जुड़े क्रेडेंशियल्स को खोजकर किया जाता है जो "@microsoft.com" पर समाप्त होने वाले ईमेल से पंजीकृत हैं। यह एकमात्र कवर किया गया उपयोग मामला है और इसका तकनीकी विकल्पों (डेटाबेस इंडेक्स और सामान्य रूप से डेटा प्रतिनिधित्व) के संदर्भ में बहुत मतलब है।
लीक कई गीगाबाइट वजन के हो सकते हैं। इसका मतलब है कि प्रत्येक प्रक्रिया (मानकीकरण, आयात और खोज) मेमोरी के संदर्भ में इन-प्लेस एल्गोरिदम का उपयोग करती है। आप पहले से जान सकते हैं कि ये उपकरण किसी विशिष्ट फ़ाइल को संसाधित करने के लिए कितनी मेमोरी का उपयोग करेंगे, और यह कभी भी आपके कंप्यूटर के संसाधनों को समाप्त नहीं करेगा (जब तक कि आपके पास बहुत पुराना कंप्यूटर न हो)।
बड़ी फ़ाइलों को संसाधित करने और बहुत सारे डेटा के साथ काम करने में समय लगता है। मेरे विचार में प्रक्रिया/आयात में कितना समय लगेगा, यह जानने के लिए दृश्य/रीयल-टाइम फीडबैक होना महत्वपूर्ण है। यह जानना महत्वपूर्ण है कि क्या आपने अभी 7 घंटे की प्रक्रिया शुरू की है या 1,200 वर्षों की लंबी प्रक्रिया।