Scrapling एक अनुकूली वेब स्क्रैपिंग फ्रेमवर्क है जो एकल अनुरोध से लेकर पूर्ण पैमाने की क्रॉलिंग तक सब कुछ संभालता है।
इसका पार्सर वेबसाइट में होने वाले बदलावों से सीखता है और जब पेज अपडेट होते हैं तो स्वचालित रूप से आपके एलिमेंट्स का पता लगा लेता है। इसके फ़ेचर्स Cloudflare Turnstile जैसे एंटी-बॉट सिस्टम को बिना किसी अतिरिक्त सेटअप के बायपास कर देते हैं। और इसका स्पाइडर फ्रेमवर्क आपको pause/resume, स्वचालित प्रॉक्सी रोटेशन, और एक क्रॉल गति के साथ समवर्ती, मल्टी-सेशन क्रॉल तक स्केल करने देता है जो इस बात के अनुसार समायोजित होती है कि प्रत्येक वेबसाइट कितनी तेज़ी से प्रतिक्रिया करती है और जब यह आपको ब्लॉक करना शुरू करती है तो पीछे हट जाती है - यह सब Python की कुछ पंक्तियों में। एक लाइब्रेरी, शून्य समझौते।
रीयल-टाइम आँकड़ों और स्ट्रीमिंग के साथ बेहद तेज़ क्रॉल। वेब स्क्रैपर्स द्वारा वेब स्क्रैपर्स और सामान्य उपयोगकर्ताओं के लिए बनाया गया, इसमें सभी के लिए कुछ न कुछ है।```python
from scrapling.fetchers import Fetcher, AsyncFetcher, StealthyFetcher, DynamicFetcher
StealthyFetcher.adaptive = True
p = StealthyFetcher.fetch('https://example.com', headless=True, network_idle=True) # Fetch website under the radar!
products = p.css('.product', auto_save=True) # Scrape data that survives website design changes!
products = p.css('.product', adaptive=True) # Later, if the website structure changes, pass adaptive=True to find them!
या फिर पूर्ण क्रॉल तक स्केल करें```python
from scrapling.spiders import Spider, Response
class MySpider(Spider):
name = "demo"
start_urls = ["https://example.com/"]
async def parse(self, response: Response):
for item in response.css('.product'):
yield {"title": item.css('h2::text').get()}
MySpider().start()