
désencombre les listes d'URLs pour le crawling/pentesting
Utiliser une liste d'URLs pour les tests de sécurité peut être pénible car il y a beaucoup d'URLs avec du contenu inintéressant/dupliqué ; uro vise à résoudre cela.
Il n'effectue aucune requête http vers les URLs et supprime :
/page/1/ et /page/2//posts/a-brief-history-of-time/page.php?id=1 et /page.php?id=2
La méthode recommandée pour installer uro est la suivante :
pipx install uro
Remarque : Si vous utilisez une version plus ancienne de python, utilisez
pipau lieu depipx
Le moyen le plus rapide d'intégrer uro dans votre flux de travail est de lui fournir des données via stdin et de les afficher dans votre terminal.
cat urls.txt | uro
uro -i input.txt
Si le fichier existe déjà, uro n'écrasera pas son contenu. Sinon, il créera un nouveau fichier.
uro -i input.txt -o output.txt
-w/--whitelist)uro ignorera toutes les autres extensions sauf celles fournies.
uro -w php asp html
Remarque : Les pages sans extension, par ex. /books/1, seront toujours incluses. Pour les supprimer également, utilisez --filter hasext.
-b/--blacklist)uro ignorera les extensions données.
uro -b jpg png js pdf
Remarque : uro a une liste d'extensions « inutiles » qu'il supprime par défaut ; cette liste sera remplacée par toutes les extensions que vous fournissez via l'option de liste noire. Les pages sans extension, par ex. /books/1, seront toujours incluses. Pour les supprimer également, utilisez --filter hasext.
Pour un contrôle fin, uro prend en charge les filtres suivants :
http://example.com/page.php?id=http://example.com/page.phphttp://example.com/page.phphttp://example.com/page.jpg qui serait autrement suppriméhttp://example.com/page/Exemple : uro --filters hasexts hasparams