Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
pdfgrab — Ferramenta para pesquisar PDFs no Google e extrair metadados de PDFs | Kitploit
Ferramentas/GitHubGitHub/c0decave/pdfgrab
OSINT (Inteligência de Fontes Abertas)ReconhecimentoAnálise de VulnerabilidadesColeta de InformaçõesForensia Digital
GitHubc0decave/pdfgrab

pdfgrab

Ferramenta para pesquisar PDFs no Google e extrair metadados de PDFs

Ver Repositório
31há 6 anosAinda não revisado

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar

pdfgrab

  • Versão 0.4.9

O que é?

Esta é uma ferramenta renascida, usada na época em que os dinossauros vagavam pela terra. Basicamente, analisa arquivos PDF em busca de metadados. Você pode apontá-la para um arquivo ou diretório com PDFs. Você pode mostrar a ela o URL de um PDF ou usar a pesquisa integrada do Google (graças à classe do mario vilas) para procurar PDFs no site alvo, baixá-los e analisá-los.

O que há de novo na 0.4.9?

  • métodos de relatório exportados para libreport.py
  • adicionados argumentos opcionais para desativar diferentes métodos de relatório
  • o relatório html ficou um pouco mais brilhante
  • adicionada função para gerar relatório html após a análise
  • exportados requests e armazenamento de dados para nova biblioteca
  • correções de código e tratamento de erro mais claro
  • removido o parâmetro obrigatório site: na flag de pesquisa -s
  • readme atualizado
  • a flag -s agora aceita vários domínios
  • registro no console mais limpo

Que informações podem ser coletadas?

Isso depende do software usado para criar o PDF. E se ele foi limpo. No entanto, o comum são as seguintes coisas:

  • Producer
  • Creator
  • CreationDate
  • ModificationDate
  • Author
  • Title
  • Subject

e mais algumas :)

Para que serve isso afinal?

Bem, isso pode ser usado para uma série de coisas. No entanto, vou focar apenas na parte de segurança. Dependendo do seu alvo, você obterá informações sobre:

  • software usado na empresa xyz
    • possíveis números de versão
      • isso ajudará você a identificar vulnerabilidades existentes
    • às vezes os PDFs são renderizados novamente, por exemplo em uploads
      • agora você pode descobrir qual é o mecanismo de renderização e encontrar bugs nele
  • quem é o autor dos documentos
    • às vezes os nomes de usuário são usuários do próprio SO
      • parabéns, você acabou de encontrar, ao analisar um PDF, um nome de usuário existente no domínio
      • combine essas informações com a primeira parte; você saberá qual usuário usa qual software
  • senhas ... preciso dizer mais?

É à prova de falhas?

De modo algum. Observe que os metadados, como qualquer outro dado, são apenas gravados nesse arquivo. Portanto, podem ser alterados antes do upload. Dito isso, a quantidade de empresas que realmente alteram esse tipo de dado é talvez de 20%. Além disso, você perceberá se está vazio ou algo parecido.

Como funciona?

Todo tipo de arquivo mais complexo que .txt ou similar usa metadados por conveniência, suporte ao cliente ou apenas para divulgar que foi usado. Há muita informação sobre metadados em diferentes tipos de arquivos, como imagens, documentos, vídeos, músicas, online. Esta ferramenta foca apenas em PDF. Se você é novo nesse termo, dê uma olhada aqui:

  • https://en.wikipedia.org/wiki/Metadata

Além disso, se você estiver interessado em uma análise real de PDF, esta ferramenta fará apenas o básico para você. Ela não foi escrita para analisar arquivos ruins, malware ou mesmo interessantes. Seu propósito é dar uma ideia do que é usado no alvo xyz. Se você procura uma análise mais aprofundada, recomendo as ferramentas de Didier Stevens:

  • https://blog.didierstevens.com/programs/pdf-tools/

Download

root@kitploit:~
git clone https://github.com/c0decave/pdfgrab
cd pdfgrab
python3 pdfgrab.py -h

Uso

Essas são suas principais opções:

  • pegar pdf de url e analisar
  • pesquisar site por pdfs via google, pegar e analisar
  • analisar um pdf local
  • analisar um diretório local com pdfs

Modo URL Único

root@kitploit:~
# ./pdfgrab.py -u https://www.kernel.org/doc/mirror/ols2004v2.pdf

Resultado:

root@kitploit:~
[+] Grabbing https://www.kernel.org/doc/mirror/ols2004v2.pdf
[+] Written 3893173 bytes for File: pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

Modo Arquivo Único

root@kitploit:~
# ./pdfgrab.py -f pdfgrab/ols2004v2.pdf 

Resultado:

root@kitploit:~
[+] Parsing pdfgrab/ols2004v2.pdf
[+] Opening pdfgrab/ols2004v2.pdf
--------------------------------------------------------------------------------
File: pdfgrab/ols2004v2.pdf
/Producer pdfTeX-0.14h
/Creator TeX
/CreationDate D:20040714015300
--------------------------------------------------------------------------------

Modo Diretório

root@kitploit:~
./pdfgrab.py -F pdfgrab/

Analisará todos os pdfs nesse diretório

Modo Pesquisa Google

root@kitploit:~
# ./pdfgrab.py -s kernel.org

Resultado:

root@kitploit:~
[+] Seek and analysing site:kernel.org
http://vger.kernel.org/lpc_bpf2018_talks/bpf_global_data_and_static_keys.pdf
http://vger.kernel.org/netconf2018_files/JiriPirko_netconf2018.pdf
http://vger.kernel.org/netconf2018_files/PaoloAbeni_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/LPC_XDP_Shirokov_paper_v1.pdf
http://vger.kernel.org/netconf2018_files/FlorianFainelli_netconf2018.pdf
http://vger.kernel.org/lpc_net2018_talks/tc_sw_paper.pdf
https://www.kernel.org/doc/mirror/ols2009.pdf
https://www.kernel.org/doc/mirror/ols2004v2.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf.pdf
http://vger.kernel.org/lpc_net2018_talks/ktls_bpf_paper.pdf

[+] Written 211391 bytes for File: pdfgrab/bpf_global_data_and_static_keys.pdf
[+] Opening pdfgrab/bpf_global_data_and_static_keys.pdf
--------------------------------------------------------------------------------
File: pdfgrab/bpf_global_data_and_static_keys.pdf
/Author 
/Title 
/Subject 
/Creator LaTeX with Beamer class version 3.36
/Producer pdfTeX-1.40.17
/Keywords 
/CreationDate D:20181102231821+01'00'
/ModDate D:20181102231821+01'00'
/Trapped /False
/PTEX.Fullbanner This is pdfTeX, Version 3.14159265-2.6-1.40.17 (TeX Live 2016) kpathsea version 6.2.2

Modo Pesquisa Google, vários domínios

root@kitploit:~
# ./pdfgrab.py -s example.com,example.us

Relatórios

pdfgrab gera as informações em diferentes formatos. Se não estiver desabilitado por uma das flags de relatório (veja -h), você encontrará no diretório de saída:

  • relatório html
  • relatório texto
  • lista de urls texto
  • dados json
  • lista de urls json

Registro

pdfgrab cria um arquivo de log no diretório de execução chamado "pdfgrab.log"

Google

  • Pesquisa: filetype:pdf site:com
  • Resultados: 264.000.000

Aviso Legal

Divirta-se!

Baixar ferramenta