
Scraper di contenuti di 4chan

Uno scraper completo per 4chan (Ora è veloce.)
pepeScraper è uno scraper che usa il contesto per le tue ricerche e restituisce esattamente ciò che vuoi. (Sto imparando come far sembrare un oggetto più figo di quanto sia in realtà)
Se usi Windows, vai alla sezione releases e scarica l'ultima versione, poi installa le dipendenze. Se vuoi aiutare e hai accesso al codice sorgente, usa il codice qui sotto.
git clone https://github.com/JuaanReis/pepeScraper.git
cd ./pepeScraper
pip install -r requirements.txt
py main.py --help
Non so nemmeno cosa significhi questo meme (e vaffanculo se lo sai).
PepeScraper NON memorizza automaticamente nulla.
usa solo l'API e crea un collegamento diretto a 4chan.
Niente log, cronologia, database, copia di Facebook (forse capisci).
Hai la possibilità di salvare immagini dei board, log e risultati di output, ma nulla è automatico
(a meno che tu non scelga questa opzione nel file di configurazione)
Tutto è memorizzato nella RAM e cancellato quando il programma termina. (Esatto, tua mamma non scoprirà cosa hai cercato.)
Per favore, non denunciarmi, non ho i soldi per pagare un avvocato. (A volte non ci sono nemmeno abbastanza soldi per comprare da mangiare.)
Sono serio, la pornografia può distruggere il tuo cervello, il tuo corpo e la tua famiglia (non importa quante volte lo scrivo, lo ignorerai).
python main.py --keyword "pepe" --date 01/01/2025
Questo può rendere la tua ricerca forse più sicura (non so se ho programmato bene questo).
| Flag | Descrizione | Esempio |
|---|
--key <w> | Parole chiave usate come base per la ricerca e lo scraping. | --key mustang |
--date <YYYY/MM/DD> | Data esatta in cui è stato fatto il post OP. | --date 2024/01/10 |
--before <YYYY/MM/DD> | Post precedenti alla data indicata fino ad oggi. | --before 2023/05/01 |
--after <YYYY/MM/DD> | Post successivi alla data indicata fino ad oggi. | --after 2024/02/01 |
--min-replies <n> | Numero minimo di risposte che il thread deve avere. | --min-replies 10 |
--max-replies <n> | Numero massimo di risposte che il thread può avere. | --max-replies 200 |
--board <board_name> | Nome/i del/i board da cercare. | --board g |
-T <n> | Numero di thread con cui il programma lavorerà (cambia la velocità, non il risultato). | -T 9 |
--op-only, -op | Considera solo il post originale (OP). | -op |
--no-op, -nop | Opposto di --op-only, ignora l'OP. | -nop |
--nsfw, -n | Abilita post volgari. | -n |
--nsfw-title, -nt | Abilita titoli volgari. | -nt |
--output, -o | Salva i risultati in un file di testo (solo link). | -o results.txt |
--download_image, -di | Scarica tutte le immagini dal thread. | -di |
--log <w> | Salva i log in pepescraper/data/logs. | --log scan.log |
--all-boards, -ab | Mostra tutti i board. | -ab |
--proxy, -p <w> | Connettiti tramite un proxy. | -p http://127.0.0.1:8080 |
--title, -t | Applica il termine di ricerca al titolo. | -t |
--image, -i | Filtra la ricerca per parola chiave nell'immagine. | -i |