
Utilitaire Python qui extrait le contenu de PDF pour générer des listes de mots ciblées pour les attaques par force brute, par navigation forcée et par dictionnaire, avec des modes d'analyse de fréquence des mots, d'entropie et de métadonnées.
ScrapPY est un utilitaire Python pour extraire des manuels, documents et autres PDF sensibles afin de générer des listes de mots ciblées pouvant être utilisées par des outils de sécurité offensive pour effectuer des attaques par force brute, de navigation forcée et par dictionnaire. ScrapPY effectue une analyse de la fréquence des mots, de l'entropie et des métadonnées, et peut fonctionner en modes de sortie complets pour créer des listes de mots personnalisées pour des attaques ciblées. L'outil explore en profondeur pour découvrir des mots-clés et des phrases menant à des mots de passe potentiels ou à des répertoires cachés, produisant un fichier texte lisible par des outils tels que Hydra, Dirb et Nmap. Accélérez l'accès initial, la découverte de vulnérabilités et le mouvement latéral avec ScrapPY !
Télécharger le dépôt :
$ mkdir ScrapPY
$ cd ScrapPY/
$ sudo git clone https://github.com/RoseSecurity/ScrapPY.git
Installer les dépendances :
$ python3 -m venv venv
$ source .venv/bin/activate
$ pip3 install -r requirements.txt
usage: ScrapPY.py [-h] [-f FILE] [-m {word-frequency,full,metadata,entropy}] [-o OUTPUT]
Afficher les métadonnées du document :
$ python3 ScrapPY.py -f example.pdf -m metadata
Afficher les 100 mots-clés les plus fréquents dans un fichier nommé Top_100_Keywords.txt :
$ python3 ScrapPY.py -f example.pdf -m word-frequency -o Top_100_Keywords.txt
Afficher tous les mots-clés dans le fichier par défaut ScrapPY.txt :
$ python3 ScrapPY.py -f example.pdf
Afficher les 100 mots-clés avec le taux d'entropie le plus élevé :
$ python3 ScrapPY.py -f example.pdf -m entropy
Sortie de ScrapPY :
# ScrapPY outputs the ScrapPY.txt file or specified name file to the directory in which the tool was ran. To view the first fifty lines of the file, run this command:
$ head -50 ScrapPY.txt
# To see how many words were generated, run this command:
$ wc -l ScrapPY.txt
Intégrez facilement avec des outils tels que Dirb pour accélérer le processus de découverte de sous-répertoires cachés :
root@RoseSecurity:~# dirb http://192.168.1.123/ /root/ScrapPY/ScrapPY.txt
-----------------
DIRB v2.21
By The Dark Raver
-----------------
START_TIME: Fri May 16 13:41:45 2014
URL_BASE: http://192.168.1.123/
WORDLIST_FILES: /root/ScrapPY/ScrapPY.txt
-----------------
GENERATED WORDS: 4592
---- Scanning URL: http://192.168.1.123/ ----
==> DIRECTORY: http://192.168.1.123/vi/
+ http://192.168.1.123/programming (CODE:200|SIZE:2726)
+ http://192.168.1.123/s7-logic/ (CODE:403|SIZE:1122)
==> DIRECTORY: http://192.168.1.123/config/
==> DIRECTORY: http://192.168.1.123/docs/
==> DIRECTORY: http://192.168.1.123/external/
Utilisez ScrapPY avec Hydra pour des attaques avancées par force brute :
root@RoseSecurity:~# hydra -l root -P /root/ScrapPY/ScrapPY.txt -t 6 ssh://192.168.1.123
Hydra v7.6 (c)2013 by van Hauser/THC & David Maciejak - for legal purposes only
Hydra (http://www.thc.org/thc-hydra) starting at 2014-05-19 07:53:33
[DATA] 6 tasks, 1 server, 1003 login tries (l:1/p:1003), ~167 tries per task
[DATA] attacking service ssh on port 22
Améliorez les scripts Nmap avec les listes de mots de ScrapPY :
nmap -p445 --script smb-brute.nse --script-args userdb=users.txt,passdb=ScrapPY.txt 192.168.1.123
homebrew