
4chan सामग्री स्क्रैपर

4chan के लिए एक पूर्ण स्क्रैपर (अब यह तेज़ है।)
pepeScraper एक स्क्रैपर है जो आपकी खोजों के लिए संदर्भ का उपयोग करता है और ठीक वही लौटाता है जो आप चाहते हैं। (मैं सीख रहा हूँ कि किसी आइटम को उससे अधिक अच्छा कैसे दिखाया जाए जितना वह वास्तव में है)
यदि आप Windows का उपयोग करते हैं, तो बस रिलीज़ पर जाएं और नवीनतम संस्करण डाउनलोड करें और फिर निर्भरताएं स्थापित करें। यदि आप सहायता करना चाहते हैं और स्रोत कोड तक पहुंच चाहते हैं, तो नीचे दिए गए कोड का उपयोग करें।
git clone https://github.com/JuaanReis/pepeScraper.git
cd ./pepeScraper
pip install -r requirements.txt
py main.py --help
मुझे यह भी नहीं पता कि इस मीम का क्या अर्थ है (और यदि आप जानते हैं तो आप पर धिक्कार है)।
PepeScraper स्वचालित रूप से कुछ भी संग्रहीत नहीं करता है।
यह केवल API का उपयोग करता है और 4chan का सीधा लिंक बनाता है।
कोई लॉग नहीं, कोई इतिहास नहीं, कोई डेटाबेस नहीं, कोई Facebook कॉपी नहीं (शायद आप समझ गए होंगे)।
आपके पास बोर्डों की छवियों, लॉग और आउटपुट परिणामों को सहेजने का विकल्प है, लेकिन कुछ भी स्वचालित नहीं है
(जब तक आप कॉन्फ़िगरेशन फ़ाइल में यह विकल्प नहीं चुनते)
सब कुछ RAM में संग्रहीत होता है और प्रोग्राम समाप्त होने पर हटा दिया जाता है। (हाँ, आपकी माँ को पता नहीं चलेगा कि आपने क्या खोजा।)
कृपया मुझ पर मुकदमा न करें, मेरे पास वकील को भुगतान करने के लिए पैसे नहीं हैं। (कभी-कभी खाना खरीदने के लिए भी पर्याप्त पैसे नहीं होते।)
मैं गंभीर हूँ, अश्लील साहित्य आपके मस्तिष्क, आपके शरीर और आपके परिवार को नष्ट कर सकता है (चाहे मैं यह कितनी भी बार लिखूं, आप इसे अनदेखा करेंगे)।
python main.py --keyword "pepe" --date 01/01/2025
यह आपके शोध को शायद अधिक सुरक्षित बना सकता है (मुझे नहीं पता कि मैंने इसे सही तरीके से प्रोग्राम किया है या नहीं)।
| फ़्लैग | विवरण | उदाहरण |
|---|
--key <w> | खोज और स्क्रैपिंग के आधार के रूप में उपयोग किए जाने वाले कीवर्ड। | --key mustang |
--date <YYYY/MM/DD> | वह सटीक तारीख जब OP पोस्ट बनाया गया था। | --date 2024/01/10 |
--before <YYYY/MM/DD> | दी गई तारीख से पहले आज तक के पोस्ट। | --before 2023/05/01 |
--after <YYYY/MM/DD> | दी गई तारीख के बाद आज तक के पोस्ट। | --after 2024/02/01 |
--min-replies <n> | थ्रेड में न्यूनतम प्रतिक्रियाओं की संख्या। | --min-replies 10 |
--max-replies <n> | थ्रेड में अधिकतम प्रतिक्रियाओं की संख्या। | --max-replies 200 |
--board <board_name> | खोजने के लिए बोर्ड(बोर्डों) का नाम। | --board g |
-T <n> | प्रोग्राम जितने थ्रेड के साथ काम करेगा (गति बदलता है, परिणाम नहीं)। | -T 9 |
--op-only, -op | केवल मूल पोस्ट (OP) पर विचार करें। | -op |
--no-op, -nop | --op-only के विपरीत, OP को अनदेखा करता है। | -nop |
--nsfw, -n | अश्लील पोस्ट सक्षम करें। | -n |
--nsfw-title, -nt | अश्लील शीर्षक सक्षम करें। | -nt |
--output, -o | परिणामों को एक टेक्स्ट फ़ाइल में सहेजें (केवल लिंक)। | -o results.txt |
--download_image, -di | थ्रेड से सभी छवियां डाउनलोड करें। | -di |
--log <w> | लॉग को pepescraper/data/logs में सहेजें। | --log scan.log |
--all-boards, -ab | सभी बोर्ड दिखाएं। | -ab |
--proxy, -p <w> | प्रॉक्सी के माध्यम से कनेक्ट करें। | -p http://127.0.0.1:8080 |
--title, -t | खोज शब्द को शीर्षक पर लागू करें। | -t |
--image, -i | छवि में कीवर्ड द्वारा खोज फ़िल्टर करें। | -i |