
Un scrape de linkedin completamente configurable: raspa cualquier cosa dentro de linkedin
Extrae cualquier dato de LinkedIn
$ pip install git+git://github.com/jqueguiner/lk_scraper
$ docker-compose up -d
$ docker-compose run lk_scraper python3
Primero, necesita ejecutar un servidor Selenium
$ docker run -d -p 4444:4444 --shm-size 2g selenium/standalone-firefox:3.141.59-20200326
Después de ejecutar este comando, desde el navegador navegue a su dirección IP seguida del número de puerto y /grid/console. Así que el comando será http://localhost:4444/grid/console.
Navegue a LinkedIn.com e inicie sesión
Abra las herramientas de desarrollador del navegador (Ctrl-Shift-I o clic derecho -> inspeccionar elemento)
https://www.nextscripts.com/images/sc/alt-LI-002-ch.png

Seleccione la pestaña Application
Bajo el encabezado Storage en el menú de la izquierda, haga clic en el menú desplegable Cookies y seleccione www.linkedin.com
Encuentre la cookie li_at, y haga doble clic en el valor para seleccionarlo antes de copiarlo
Seleccione la pestaña Storage
Haga clic en el menú desplegable Cookies y seleccione www.linkedin.com
Encuentre y copie el valor de li_at
Puede agregar su cookie li_at de LinkedIn en el archivo de configuración que se encuentra en su directorio personal (~/.lk_scraper/config.yml)
ver

from lk_scraper import Scraper
li_at = "My_super_linkedin_cookie"
scraper = Scraper(li_at=li_at)
(Aún no implementado)
$ export LI_AT="My_super_linkedin_cookie"
Ejecute el cuaderno Jupyter linkedin-example.ipynb
from lk_scraper import Scraper
scraper = Scraper()
from lk_scraper import Scraper
scraper = Scraper()
company = scraper.get_object(object_name='company', object_id='apple')
from lk_scraper import Scraper
scraper = Scraper()
profil = scraper.get_object(object_name='profil', object_id='jlqueguiner')