
Uno scrape di LinkedIn completamente configurabile: raschia qualsiasi cosa all'interno di LinkedIn
Recupera qualsiasi dato di LinkedIn
$ pip install git+git://github.com/jqueguiner/lk_scraper
$ docker-compose up -d
$ docker-compose run lk_scraper python3
Prima di tutto, devi eseguire un server Selenium
$ docker run -d -p 4444:4444 --shm-size 2g selenium/standalone-firefox:3.141.59-20200326
Dopo aver eseguito questo comando, dal browser naviga all'indirizzo IP seguito dal numero di porta e /grid/console. Quindi il comando sarà http://localhost:4444/grid/console.
Vai su LinkedIn.com e accedi
Apri gli strumenti di sviluppo del browser (Ctrl-Maiusc-I o clic destro -> ispeziona elemento)
https://www.nextscripts.com/images/sc/alt-LI-002-ch.png

Seleziona la scheda Applicazione
Sotto l'intestazione Storage nel menu a sinistra, clicca sul menu a discesa Cookies e seleziona www.linkedin.com
Trova il cookie li_at, e fai doppio clic sul valore per selezionarlo prima di copiarlo
Seleziona la scheda Storage
Clicca sul menu a discesa Cookies e seleziona www.linkedin.com
Trova e copia il valore li_at
Puoi aggiungere il tuo cookie li_at di LinkedIn nel file di configurazione che si trova nella tua home (~/.lk_scraper/config.yml)
vedi

from lk_scraper import Scraper
li_at = "My_super_linkedin_cookie"
scraper = Scraper(li_at=li_at)
(Non ancora implementato)
$ export LI_AT="My_super_linkedin_cookie"
Esegui il notebook Jupyter linkedin-example.ipynb
from lk_scraper import Scraper
scraper = Scraper()
from lk_scraper import Scraper
scraper = Scraper()
company = scraper.get_object(object_name='company', object_id='apple')
from lk_scraper import Scraper
scraper = Scraper()
profil = scraper.get_object(object_name='profil', object_id='jlqueguiner')