工具 wordlist_generator 会根据 tomnomnom 视频 "Who, What, Where, When" 中提到的技术生成针对目标独一无二的字典。 它从 gau 获取 URL,提取目录、文件名或页面中的单词。作为额外功能,它可以提取 HTML 注释。默认情况下,工具只会请求 2000 个 URL,提取所有单词和目录。
为了清理字典,wordlist_generator 会从 "denylists" 目录文件中的结果中移除所有内容,只保留唯一单词。同时,它使用 BonJarber 的 clean_wordlist 工具中的正则表达式进行清理。你可以调整 parsing_allow_extensions.txt 和 scraping_deny_extensions.txt 中在解析文件和抓取页面时忽略的扩展名。
示例:
$ ./wordlist_generator.py -d hackerone.com -a 20 -files
$ ./wordlist_generator.py -d bugcrowd.com -a 7500 -dir
$ ./wordlist_generator.py -d intigriti.com > intigriti_wordlist.txt
使用 -h 标志显示帮助:
./wordlist_generator.py -h
| 标志 | 描述 | 示例 |
|---|---|---|
-domain | 目标域 | ./wordlist_generator.py -d openbugbounty.org |
-amount | 从 gau 获取的 URL 数量 | ./wordlist_generator.py -d twitter.com -a 10000 |
-dir | 仅提取目录 | ./wordlist_generator.py -d hackerone.com -dir |
-f | 仅提取文件名 | ./wordlist_generator.py -d hackerone.com -f |
-c | 仅提取注释且不过滤 | ./wordlist_generator.py -d hackerone.com -c |
$ GO111MODULE=on go get -u -v github.com/lc/gau
$ git clone https://github.com/SomeKirill/wordlist_generator/
$ pip3 install -r requirements.txt