vk-scraper 是一个用 Python 编写的命令行应用程序,用于抓取和下载 VK 用户/社区的数据。请负责任地使用。
要更好地了解其工作原理,请前往文档。
对于稳定版(vk-scraper):
git clone https://aur.archlinux.org/vk-scraper.git vk-scraper
对于 git 版本(vk-scraper-git):
git clone https://aur.archlinux.org/vk-scraper-git.git vk-scraper
然后构建并安装:
cd vk-scraper
makepkg -sic
或者使用你选择的 AUR 助手。
对于稳定版:
$ pip3 install vk-scraper --upgrade --user
对于 git 版本:
$ pip3 install git+https://github.com/vanyasem/VK-Scraper.git --upgrade --user
要抓取媒体:
vk-scraper <用户名/社区> -u <你的用户名> -p <你的密码>
默认情况下,下载的媒体将放置在 <当前工作目录>/<用户名> 中。
要指定多个用户/社区,请传入以逗号分隔的用户列表:
vk-scraper username1,community1,username2,username3,community2
你也可以提供一个包含用户/社区列表的文件:
vk-scraper -f scrape_list.txt
$ cat vk_users.txt
username1
community1
username2
username3
community2
...
用户名可以用换行符、逗号、分号或空格分隔。
--help -h 显示帮助信息并退出
--login-user -u 你的 VK 用户名
--login-pass -p 你的 VK 密码
--filename -f 包含要抓取的用户/社区列表的文件路径
--destination -d 指定目标文件夹。默认情况下,媒体将
下载到 <当前工作目录>/<用户名>
--retain-username -n 设置此标志后,为每个抓取的名字创建子目录
--media-types -t 指定要抓取的媒体类型。以空格分隔的值输入。
有效值为 image、saved、video、story、wall 或 none
(默认为 image)
--latest 仅抓取上次抓取后的新媒体。使用目标目录中最新媒体
项目的修改时间进行比较
--quiet -q 抓取时保持安静
--maximum -m 要抓取的最大项目数
--offset -o 抓取开始的偏移量。0 表示从最旧的开始。(默认为 0)