Skip to content
KitploitKITPLOIT
HerramientasExploitsBlog
Log in
Enviar
HerramientasExploitsBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

··Feeds·Contacto·Privacidad·© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
urx — Extrae URLs de archivos OSINT para obtener información de seguridad. | Kitploit
Herramientas/GitHubGitHub/hahwul/urx
OSINT (Inteligencia de Fuentes Abiertas)ReconocimientoRecopilación de InformaciónSeguridad WebCrawler
GitHubhahwul/urx

urx

Extrae URLs de archivos OSINT para obtener información de seguridad.

Ver Repositorio
1902050hace 5 díasRevisado por Kitploit

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Compartir
Sitio web
Urx Logo

Extrae URLs de archivos OSINT para obtener información de seguridad.

Urx es una herramienta de línea de comandos diseñada para recopilar URLs de archivos OSINT, como Wayback Machine y Common Crawl. Construida con Rust para mayor eficiencia, aprovecha el procesamiento asíncrono para consultar rápidamente múltiples fuentes de datos. Esta herramienta simplifica el proceso de recopilación de información de URLs para un dominio específico, proporcionando un conjunto de datos completo que puede utilizarse para diversos fines, incluidos las pruebas de seguridad y el análisis.

Características

  • Obtiene URLs de múltiples fuentes en paralelo (Wayback Machine, Common Crawl, OTX, Arquivo.pt)
  • Conecta cualquier otro servidor de índice CDX — archivos web nacionales, un pywb privado, OutbackCDX — con --cdx-endpoint URL, sin necesidad de cambiar el código
  • Sin claves por defecto: Wayback, Common Crawl, OTX, Arquivo.pt y URLScan (anónimo) funcionan sin una clave de API
  • Proveedor BeVigil: URLs extraídas de aplicaciones Android desempaquetadas — endpoints que ningún archivo web llegó a rastrear
  • Soporte de rotación de claves de API para los proveedores VirusTotal y URLScan para mitigar los límites de velocidad
  • Pruebas autenticadas: -H, --cookie y --user-agent se aplican a cada solicitud que urx realiza al objetivo (--check-status, --extract-links, --extract-js-endpoints, --expand-specs) y deliberadamente nunca se envían a un archivo
  • Filtra resultados por extensiones de archivo, patrones de subcadenas o expresiones regulares completas (--match-regex / --filter-regex)
  • Presets predefinidos, tanto por familia de archivos ("no-images", "only-js") como por interés de seguridad ("only-secrets", "only-backup", "only-config", "only-api")
  • Filtrado del lado del archivo: envía el código de estado, el tipo MIME y el rango de fechas directamente a la consulta CDX, de modo que las capturas filtradas nunca cruzan la red
  • Filtrado de metadatos del lado del cliente (--meta-*): filtra por fecha de primera/última captura, tipo MIME registrado y estado registrado de forma uniforme en todos los proveedores, tras la recopilación
  • Objetivos con alcance de ruta: urx example.com/shop envía el alcance directamente a la consulta CDX (url=example.com/shop*), por lo que un subárbol de un sitio grande cuesta una fracción del índice completo en lugar de filtrarse del lado del cliente
  • Archivos de alcance de bug-bounty (--scope-file): la propia lista *.example.com / !admin.example.com de un programa utilizada textualmente, repetible y unida, con las exclusiones siempre prevaleciendo
  • Normalización y deduplicación de URLs: ordena los parámetros de consulta, elimina las barras finales, fusiona URLs semánticamente idénticas y colapsa casi-duplicados que difieren solo en ids, hashes o fechas (--dedup-similar)
  • Soporte para múltiples formatos de salida: texto plano, JSON, JSON Lines, CSV y wordlist — los segmentos de ruta y nombres de parámetros con los que se construye el objetivo, dejando fuera ids, hashes y fechas
  • Vistas de parámetros y fuzzing: --params (el inventario completo de parámetros del objetivo), --params-by-endpoint (qué endpoint acepta qué) y --fuzz-placeholder FUZZ (una URL con plantilla por firma de parámetro, lista para ffuf o dalfox)
  • Metadatos de captura del archivo: first_seen, last_seen, mime, archive_status y digest se devuelven con cada URL que un archivo CDX reportó, sin coste de red adicional
  • Salida en streaming (--stream): las URLs se escriben a medida que cada proveedor las reporta, por lo que un pipeline empieza a funcionar de inmediato en lugar de esperar al archivo más lento
  • Soporte de entrada directa de archivos: lee URLs directamente desde archivos WARC, archivos comprimidos de URLTeam y archivos de texto
  • Envía los resultados a la consola o a un archivo, o transmítelos por stdin para la integración en pipelines
  • Pruebas de URLs:
    • Filtra y valida URLs según códigos de estado HTTP y patrones.
    • Extrae enlaces adicionales de las URLs recopiladas — anclas, scripts, hojas de estilo, acciones de formularios, iframes, imágenes, fuentes multimedia, objetos, embeds y objetivos de meta-refresh
    • Mina los cuerpos de respuesta archivados de las URLs recopiladas (--archive-body), de modo que las páginas que ya no existen siguen entregando los enlaces que contenían — una solicitud por cuerpo distinto, gracias a la deduplicación por digest de CDX
    • Con --extract-js-endpoints, mina también el JavaScript archivado: un bundle nombrado por hash de compilación devuelve 404 en el momento en que el sitio se redespliega, y el archivo es el único lugar donde su superficie de API sigue existiendo
    • Conserva los cuerpos reproducidos (--archive-body-dir) como un corpus para buscar con grep lo que ningún extractor de enlaces busca — comentarios de desarrolladores, credenciales incrustadas, nombres de host internos — sin solicitudes adicionales
    • Expande especificaciones de API (--expand-specs): documentos OpenAPI 3.x, Swagger 2.0 e introspección de GraphQL, en JSON o YAML, convertidos en cada ruta que describen — una solicitud compra toda la superficie documentada
    • Metadatos de respuesta: --check-status también registra Location, Content-Length y Content-Type, y --check-title añade el <title> HTML
  • Descubrimiento de robots.txt y sitemap.xml archivados (--archived-discovery): cada versión distinta que conserva Wayback Machine, de modo que un Disallow: de 2015 sigue nombrando las rutas que el sitio ha dejado de mencionar desde entonces
  • Caché y escaneo incremental:
    • Caché local en SQLite o remota en Redis para evitar reescanear dominios
    • Modo incremental para descubrir solo URLs nuevas desde el último escaneo
    • TTL de caché configurable y limpieza automática de entradas caducadas
    • Subcomando urx cache para inspeccionar y mantener la caché: stats, list, prune, drop <domain>, clear

Preview

Instalación

Desde Cargo```bash

https://crates.io/crates/urx

cargo install urx

### Desde Homebrew```bash
# https://formulae.brew.sh/formula/urx
brew install urx

Desde el código fuente```bash

git clone https://github.com/hahwul/urx.git cd urx cargo build --release

El binario compilado estará disponible en `target/release/urx`.

### Desde Docker

[ghcr.io/hahwul/urx](https://github.com/hahwul/urx/pkgs/container/urx)

### Autocompletado de Shell
Descargar herramienta