
Инструмент командной строки для сбора и загрузки медиа (фотографий, видео, историй) из профилей и сообществ ВКонтакте с использованием VK API. Поддерживает несколько целей, фильтрацию по типу медиа и инкрементальную загрузку.
vk-scraper — это консольное приложение на Python, которое собирает и скачивает данные из профилей/сообществ VK. Используйте ответственно.
Чтобы лучше понять, как это работает, обратитесь к документации.
Для стабильной версии (vk-scraper):
git clone https://aur.archlinux.org/vk-scraper.git vk-scraper
Для git версии (vk-scraper-git):
git clone https://aur.archlinux.org/vk-scraper-git.git vk-scraper
Затем соберите и установите:
cd vk-scraper
makepkg -sic
Или используйте AUR-помощник по вашему выбору.
Для стабильной версии:
$ pip3 install vk-scraper --upgrade --user
Для git версии:
$ pip3 install git+https://github.com/vanyasem/VK-Scraper.git --upgrade --user
Для сбора медиа:
vk-scraper <username/community> -u <your username> -p <your password>
По умолчанию скачанные медиа помещаются в <текущая рабочая директория>/<имя пользователя>.
Чтобы указать несколько пользователей/сообществ, передайте список через запятую:
vk-scraper username1,community1,username2,username3,community2
Также можно указать файл со списком пользователей/сообществ:
vk-scraper -f scrape_list.txt
$ cat vk_users.txt
username1
community1
username2
username3
community2
...
Имена пользователей могут быть разделены переводами строк, запятыми, точками с запятой или пробелами.
--help -h Show help message and exit
--login-user -u Your VK username
--login-pass -p Your VK password
--filename -f Path to a file containing a list of users/communities to scrape
--destination -d Specify destination folder. By default, media will
be downloaded to <current working directory>/<username>
--retain-username -n Creates a subdirectory for each scraped name when the flag is set
--media-types -t Specify media types to scrape. Enter as space separated values.
Valid values are image, saved, video, story, wall, or none
(defaults to image)
--latest Scrape only new media since the last scrape. Uses the last modified
time of the latest media item in the destination directory for comparasion
--quiet -q Be quiet while scraping
--maximum -m Maximum number of items to scrape
--offset -o Offset from which the scrape starts. 0 is from the oldest. (Defaults to 0)