
ユニークなワードリストを生成するジェネレーター。
wordlist_generator ツールは、tomnomnom のビデオ "Who, What, Where, When" で説明されている手法を使用して、対象に固有のワードリストを生成します。 URL を gau から取得し、ディレクトリ、ファイル名、またはページ上の単語を抽出します。追加機能として、HTML コメントを抽出することもできます。デフォルトでは、ツールは 2000 件の URL のみをリクエストし、すべての単語とディレクトリを抽出します。
ワードリストをクリーンアップするために、wordlist_generator は結果から "denylists" ディレクトリのファイルに含まれるすべての単語を削除し、ユニークな単語のみを残します。また、BonJarber の clean_wordlist ツールの正規表現を使用して結果をクリーンアップします。ファイルの解析中やページの取得中に無視する拡張子を、parsing_allow_extensions.txt および scraping_deny_extensions.txt で調整できます。
例:
$ ./wordlist_generator.py -d hackerone.com -a 20 -files
$ ./wordlist_generator.py -d bugcrowd.com -a 7500 -dir
$ ./wordlist_generator.py -d intigriti.com > intigriti_wordlist.txt
ツールのヘルプを表示するには、-h フラグを使用します:
./wordlist_generator.py -h
| Flag | 説明 | 例 |
|---|---|---|
-domain | 対象ドメイン | ./wordlist_generator.py -d openbugbounty.org |
-amount | gau から取得する URL の数 | ./wordlist_generator.py -d twitter.com -a 10000 |
-dir | ディレクトリのみ抽出 | ./wordlist_generator.py -d hackerone.com -dir |
-f | ファイル名のみ抽出 | ./wordlist_generator.py -d hackerone.com -f |
-c | コメントのみをフィルタリングなしで抽出 | ./wordlist_generator.py -d hackerone.com -c |
$ GO111MODULE=on go get -u -v github.com/lc/gau
$ git clone https://github.com/SomeKirill/wordlist_generator/
$ pip3 install -r requirements.txt