Skip to content
KitploitKITPLOIT
HerramientasBlog
Enviar
HerramientasBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

··Feeds·Contacto·Privacidad·© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
pagesource — CLI para descargar los JS/CSS/assets reales de los sitios web (no HTML aplanado) | Kitploit
Herramientas/GitHubGitHub/timf34/pagesource
Utilidades de Propósito GeneralReconocimientoRecopilación de InformaciónSeguridad WebUtilidades y FrameworksCrawler
GitHubtimf34/pagesource

pagesource

CLI para descargar los JS/CSS/assets reales de los sitios web (no HTML aplanado)

Ver Repositorio
36031hace 7 mesesRevisado por Kitploit

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Compartir
Sitio web

pagesource

Una herramienta CLI de Python que captura todos los recursos cargados por una página web (como la pestaña Sources de las DevTools del navegador) y los guarda conservando la estructura de directorios original.

Diagrama explicativo

Instalación

root@kitploit:~
pip install pagesource

# IMPORTANT: Install Playwright browser after package installation
playwright install chromium

Uso

Uso básico

root@kitploit:~
# Capture all resources from a webpage
pagesource https://example.com

Esto guardará todos los recursos en ./pagesource_output/ conservando la estructura de directorios.

Opciones

root@kitploit:~
# Specify custom output directory
pagesource https://example.com -o ./my-output

# Wait extra time for JavaScript content (useful for SPAs)
pagesource https://example.com --wait 5

# Include external resources (CDN assets, third-party scripts)
pagesource https://example.com --include-external

# Combine options
pagesource https://example.com -o ./output --wait 3 --include-external

Referencia de CLI

root@kitploit:~
pagesource <url> [OPTIONS]

Arguments:
  url                     URL of the webpage to capture resources from

Options:
  -o, --output PATH       Output directory (default: ./pagesource_output)
  -w, --wait INTEGER      Additional seconds to wait after page load
  -e, --include-external  Include external resources (CDN, third-party)
  -v, --version           Show version and exit
  --help                  Show help message

Estructura de salida

Los recursos se guardan conservando la estructura de la ruta URL:

root@kitploit:~
pagesource_output/
└── example.com/
    ├── index.html
    ├── assets/
    │   ├── css/
    │   │   └── style.css
    │   └── js/
    │       └── app.js
    └── images/
        └── logo.png

Si se usa --include-external, los recursos externos se guardan en sus propios directorios de host:

root@kitploit:~
pagesource_output/
├── example.com/
│   └── ...
├── cdn.example.com/
│   └── libs/
│       └── library.js
└── fonts.googleapis.com/
    └── css/
        └── font.css

Características

  • Captura todos los recursos de red cargados por la página (HTML, CSS, JS, imágenes, fuentes, etc.)
  • Conserva la estructura de directorios original
  • Maneja cadenas de consulta (las elimina de los nombres de archivo)
  • Infiere extensiones de archivo a partir de Content-Type cuando faltan
  • Maneja nombres de archivo duplicados
  • Sanea rutas para la seguridad del sistema de archivos
  • Tiempo de espera opcional para páginas con mucho JavaScript

Requisitos

  • Python 3.10+
  • Playwright (con navegador Chromium)

Licencia

MIT

Descargar herramienta