
Utilitaire pour télécharger et extraire les métadonnées de documents d'une organisation. Cette technique peut être utilisée pour identifier : les domaines, les noms d'utilisateur, les numéros de version des logiciels et les conventions de nommage.
PyMeta est une réécriture en Python3 de l'outil PowerMeta, créé par dafthack en PowerShell. Il utilise des requêtes de recherche spécialement conçues pour identifier et télécharger les types de fichiers suivants (pdf, xls, xlsx, csv, doc, docx, ppt, pptx) à partir d'un domaine donné en utilisant le scraping de Google et Bing.
Une fois téléchargés, les métadonnées sont extraites de ces fichiers à l'aide d'exiftool de Phil Harvey et ajoutées à un rapport .csv. Alternativement, Pymeta peut être pointé vers un répertoire pour extraire les métadonnées de fichiers téléchargés manuellement en utilisant l'argument de ligne de commande -dir. Voir la section Utilisation ou Toutes les options pour plus d'informations.
Les métadonnées sont un endroit courant pour les testeurs d'intrusion et les red teamers pour trouver : des domaines, des comptes utilisateurs, des conventions de nommage, des numéros de version/logiciels, et plus encore !
Exiftool est requis et peut être installé avec :
Ubuntu/Kali - apt-get install exiftool -y
Mac OS - brew install exiftool
Installez la dernière version stable depuis PyPi :
pip3 install pymetasec
Ou, installez le code le plus récent depuis GitHub :
git clone https://github.com/m8sec/pymeta
cd pymeta
python3 setup.py install
Recherchez sur Google et Bing des fichiers dans example.com et extrayez les métadonnées vers un rapport csv :
pymeta -d example.com
Extrayez les métadonnées de fichiers dans le répertoire donné et créez un rapport csv :
pymeta -dir Downloads/
options:
-h, --help affiche ce message d'aide et quitte
-T MAX_THREADS Nombre max de threads pour le téléchargement (Défaut=5)
-t TIMEOUT Délai d'attente max par recherche (Défaut=8)
-j JITTER Variation entre les requêtes (Défaut=1)
Search Options:
-s ENGINE, --search ENGINE Moteur de recherche (Défaut='google,bing')
--file-type FILE_TYPE Types de fichiers à rechercher (défaut=pdf,xls,xlsx,csv,doc,docx,ppt,pptx)
-m MAX_RESULTS Nombre max de résultats par type de recherche
Proxy Options:
--proxy PROXY Requêtes via proxy (IP:Port)
--proxy-file PROXY Charger des proxies depuis un fichier pour rotation
Output Options:
-o DWNLD_DIR Chemin pour créer le dossier de téléchargement (Défaut: ./)
-f REPORT_FILE Nom de rapport personnalisé ("pymeta_report.csv")
Target Options:
-d DOMAIN Domaine cible
-dir FILE_DIR Répertoire préexistant de fichiers