Skip to content
KitploitKITPLOIT
ツールブログ
提出
ツールブログ
提出

ハッキング、侵入テスト、サイバーセキュリティツールをあなたのセキュリティアーセナルに!

Kitploitはハッキング、サイバーセキュリティ、ペネトレーションテストのツールディレクトリです。最新のプロジェクトアップデートを見つけて、脆弱性の発見、システム分析、テストの自動化、セキュリティの強化を行いましょう。

··フィード·お問い合わせ·プライバシー·© 2026 Kitploit

ツールディレクトリ

カテゴリ

すべてのカテゴリを見る
Loading categories
pdfgrab — Google 内で PDF を検索し、PDF メタデータを抽出するためのツール | Kitploit
ツール/GitHubGitHub/c0decave/pdfgrab
OSINT (オープンソースインテリジェンス)偵察脆弱性分析情報収集デジタルフォレンジック
GitHubc0decave/pdfgrab

pdfgrab

Google 内で PDF を検索し、PDF メタデータを抽出するためのツール

リポジトリを見る
316年前未レビュー

人気

すべて見る →

コミュニティで最も使われているツールを見つけましょう。

すべてのツールを探索

ツールコレクションを閲覧

すべてのツールを見る →
共有

pdfgrab

  • バージョン 0.4.9

これは何?

このツールは、恐竜が地球を歩き回っていた時代に使われていたツールの生まれ変わりです。 基本的にはPDFファイルのメタデータを解析します。PDFファイルを指定して、ファイルまたはディレクトリを対象にできます。 PDFのURLを指定することもできますし、統合されたGoogle検索(mario vilas氏のクラスに感謝)を使って対象サイトのPDFを検索し、ダウンロードして解析することもできます。

0.4.9での新機能は?

  • レポート出力メソッドをlibreport.pyにエクスポート
  • さまざまなレポート出力を無効化するためのオプション引数を追加
  • HTMLレポートを少し見栄え良くしました
  • 解析後にHTMLレポートを生成する関数を追加
  • requestsとデータ保存を新しいライブラリにエクスポート
  • コード修正とエラーハンドリングの明確化
  • 検索フラグ -s で不要だった site: パラメータを削除
  • READMEを更新
  • -s フラグで複数ドメインを指定可能に
  • コンソールログをよりクリーンに

どんな情報が取得できるの?

これはPDFの作成に使われたソフトウェアと、そのPDFがクリーンアップされているかどうかによります。 ただし、一般的には以下のものが取得できます:

  • Producer(プロデューサー)
  • Creator(クリエイター)
  • CreationDate(作成日)
  • ModificationDate(変更日)
  • Author(著者)
  • Title(タイトル)
  • Subject(件名)

その他にもいろいろあります :)

これは一体何のために使うの?

まあ、これはいろいろな用途に使えます。ただし、ここではセキュリティ部分にだけ焦点を当てます。 対象によって、以下の情報が得られます:

  • xyz社で使われているソフトウェア
    • バージョン番号も取得可能
      • 既知の脆弱性を特定するのに役立ちます
    • PDFがアップロード時などに再レンダリングされることがある
      • レンダリングエンジンを特定し、そのバグを見つけることができます
  • ドキュメントの作成者は誰か
    • ユーザー名がOSのユーザー名と同じ場合がある
      • おめでとうございます。PDFを解析しただけでドメイン内の既存ユーザー名を見つけました
      • この情報を最初の部分と組み合わせると、どのユーザーがどのソフトウェアを使っているかがわかります
  • パスワード... これ以上言う必要はありますか?

完璧なの?

まったくそんなことはありません。メタデータは他のデータと同じように、単にファイルに書き込まれるだけだという点に注意してください。つまり、アップロード前に変更され得るということです。とはいえ、実際にその種のデータを変更している企業の割合はおそらく20%程度です。また、空だったり似たような状態であれば、それも認識できます。

どうやって動作するの?

.txtなどの単純なファイルタイプを超える複雑なファイルタイプは、利便性やカスタマーサポート、または使用されたことを広めるためだけにメタデータを使用しています。 画像、ドキュメント、動画、音楽など、さまざまな種類のファイルのメタデータに関する情報はオンラインに豊富にあります。このツールはPDFのみに焦点を当てています。 この用語に馴染みがない場合は、こちらをご覧ください:

  • https://en.wikipedia.org/wiki/Metadata

また、実際のPDF解析に興味がある場合、このツールは基本処理のみを行います。悪意のあるファイル、マルウェア、あるいは興味深いファイルを解析するために書かれたものではありません。その目的は、対象xyzで何が使われているかの手掛かりを与えることです。 より詳細な解析をお探しなら、Didier Stevens氏のツールをお勧めします:

  • https://blog.didierstevens.com/programs/pdf-tools/

ダウンロード

root@kitploit:~
git clone https://github.com/c0decave/pdfgrab
cd pdfgrab
python3 pdfgrab.py -h

使用方法

主なオプションは次のとおりです:

  • URLからPDFを取得して解析
  • Google経由でサイト内のPDFを検索し、取得して解析
  • ローカルのPDFを解析
  • ローカルのPDFが入ったディレクトリを解析

単一URLモード

root@kitploit:~
# ./pdfgrab.py -u https://www.kernel.org/doc/mirror/ols2004v2.pdf

結果:

root@kitploit:~
[+] Grabbing https://www.kernel.org/doc/mirror/ols2004v2.pdf
[+] Written 3893173 bytes for File: pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

単一ファイルモード

root@kitploit:~
# ./pdfgrab.py -f pdfgrab/ols2004v2.pdf 

結果:

root@kitploit:~
[+] Parsing pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

ディレクトリモード

root@kitploit:~
./pdfgrab.py -F pdfgrab/

そのディレクトリ内のすべてのPDFを解析します。

Google検索モード

root@kitploit:~
# ./pdfgrab.py -s kernel.org

結果:

root@kitploit:~
[+] Seek and analysing site:kernel.org
http://vger.kernel.org/lpc_bpf2018_talks/bpf_global_data_and_static_keys.pdf
http://vger.kernel.org/netconf2018_files/JiriPirko_netconf2018.pdf
http://vger.kernel.org/netconf2018_files/PaoloAbeni_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/LPC_XDP_Shirokov_paper_v1.pdf
http://vger.kernel.org/netconf2018_files/FlorianFainelli_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/tc_sw_paper.pdf
https://www.kernel.org/doc/mirror/ols2009.pdf
https://www.kernel.org/doc/mirror/ols2004v2.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf_paper.pdf

[+] Written 211391 bytes for File: pdfgrab/bpf_global_data_and_static_keys.pdf
[+] Opening pdfgrab/bpf_global_data_and_static_keys.pdf
--------------------------------------------------------------------------------
File: pdfgrab/bpf_global_data_and_static_keys.pdf
/Author 
/Title 
/Subject 
/Creator LaTeX with Beamer class version 3.36
/Producer pdfTeX-1.40.17
/Keywords 
/CreationDate D:20181102231821+01'00'
/ModDate D:20181102231821+01'00'
/Trapped /False
/PTEX.Fullbanner This is pdfTeX, Version 3.14159265-2.6-1.40.17 (TeX Live 2016) kpathsea version 6.2.2

Google検索モード、複数ドメイン

root@kitploit:~
# ./pdfgrab.py -s example.com,example.us

レポート出力

pdfgrabは情報をさまざまな形式で出力します。レポート関連フラグ(-hを参照)のいずれかで無効にしない限り、出力ディレクトリに次のものが生成されます:

  • htmlレポート
  • テキストレポート
  • テキストURLリスト
  • jsonデータ
  • json URLリスト

ロギング

pdfgrabは実行ディレクトリに "pdfgrab.log" というログファイルを作成します。

Google

  • 検索:filetype:pdf site:com
  • 結果:264.000.000

免責事項

楽しんでください!

ツールをダウンロード