Skip to content
KitploitKITPLOIT
HerramientasBlog
Enviar
HerramientasBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

··Feeds·Contacto·Privacidad·© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
SCRAPPER — Raspa la web de forma fácil | Kitploit
Herramientas/GitHubGitHub/bunelysiareact/scrapper
OSINT (Inteligencia de Fuentes Abiertas)ReconocimientoIngeniería InversaPruebas de Seguridad de APIsDepuradoresRecopilación de InformaciónSeguridad WebPruebas de PenetraciónCrawler
GitHubbunelysiareact/scrapper

SCRAPPER

Raspa la web de forma fácil

134hace 5 mesesAún no revisado

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Compartir
Ver Repositorio
Sitio web

🕷️ SCRAPPER de BertUI

El Observador de Sesiones para Automatización Web

SCRAPPER no es un scraper — es un OBSERVADOR DE SESIONES que captura los datos reales de tu navegador para usarlos en cualquier herramienta de automatización.
Construido sobre el Framework React BertUI
GitHub: BunElysiaReact/SCRAPY
Sin dominio. Sin nube. Todo local. Todo tuyo.

Panel SCRAPPER


📋 Tabla de Contenidos

  • El Problema que SCRAPPER Resuelve
  • Qué Es SCRAPPER (Y Qué No Es)
  • Cómo Funciona SCRAPPER
  • Qué Captura SCRAPPER
  • Ventajas y Desventajas
  • API de Datos Universal
  • Inicio Rápido — Linux / macOS
  • Inicio Rápido — Windows
  • Extensiones de Navegador
  • Usar Datos Capturados en tus Herramientas
  • Resumen del Panel
  • Uso en Producción y Automatización
  • Contribuir

🤔 El Problema que SCRAPPER Resuelve

Cada herramienta de automatización web — Puppeteer, Playwright, Selenium, incluso curl — comparte los mismos desafíos:

El verdadero problema: Todas estas herramientas intentan imitar a un humano. Pero adivinan cómo se ve un humano real.


💡 Qué Es SCRAPPER (Y Qué No Es)

SCRAPPER no raspa. Te da los datos REALES que TÚ necesitas para raspar con éxito.


🔄 Cómo Funciona SCRAPPER

Fase 1: Captura (Navegador Abierto, Tú Navegas)

root@kitploit:~
TÚ                                               SCRAPPER
  │                                                  │
  ├── Abres Brave/Chrome/Firefox con extensión ──────►│
  │                                                  │
  ├── Te logueas en sitios que quieres automatizar ──►│ captura:
  │                                                  │  • Cookies
  ├── Navegas normalmente, haces clic ──────────────►│  • Tokens
  │                                                  │  • Huella
  └── Terminas de navegar ──────────────────────────►│  • Solicitudes API
                                                     │  • Estructura DOM

Fase 2: Automatiza (El Navegador Puede Cerrarse, Tú Programas)

root@kitploit:~
TU SCRIPT ──── GET /api/v1/session/all ────► API SCRAPPER (localhost:8080)
              ◄── { cookies, tokens, fingerprint } ────────────────────────┘
                │
                ▼
         Puppeteer / Playwright / Selenium / Python requests / curl
                │
                ▼
         ✅ Solicitudes autenticadas con TU sesión real

🎬 Verlo en Acción

El Panel — 258 solicitudes de claude.ai capturadas

Panel SCRAPPER Respuestas

El Popup de la Extensión — Feed en vivo, captura rápida, estadísticas en tiempo real

Extensión SCRAPPER

El Instalador — Un comando, 5 pasos, listo

Instalador SCRAPPER

Registrar ID de Extensión — Un comando después de cargar la extensión

Registrar Extensión

Ejemplo del Mundo Real — Hablando con Claude.ai desde la terminal vía SCRAPPER

Chat Claude vía SCRAPPER

El script anterior usó SCRAPPER para capturar una sesión real de claude.ai, luego envió mensajes directamente a través de la API — cero código de inicio de sesión, cero Puppeteer, cero automatización de navegador.


📦 Qué Captura SCRAPPER

root@kitploit:~
📦 Datos de Sesión
   ├── 🍪 Cookies (incluyendo HttpOnly, Secure, todos los dominios)
   ├── 💾 localStorage y sessionStorage
   ├── 🔑 Tokens de autenticación (Bearer, JWT, CSRF, personalizados)
   └── 📨 Todos los encabezados HTTP

🖥️ Huella del Navegador
   ├── 📱 User Agent
   ├── 🖼️ Resolución de pantalla y profundidad de color
   ├── 🌍 Configuración de zona horaria e idioma
   └── 📨 Conjunto completo de encabezados (Accept, Accept-Language, etc.)

📡 Tráfico de Red
   ├── 📤 Todas las solicitudes HTTP (URLs, métodos, encabezados, datos POST)
   ├── 📥 Todas las respuestas HTTP (estado, encabezados, cuerpos)
   └── 🔄 Tramas WebSocket

🌳 Estado del DOM
   ├── 📄 Instantáneas DOM
   ├── 🎯 Prueba de selectores en vivo
   └── 🗺️ Mapas DOM (todas las etiquetas, clases, IDs)

⚖️ Ventajas y Desventajas

✅ Ventajas

❌ Desventajas


📡 API de Datos Universal

Una vez capturado, SCRAPPER sirve todo a través de una API REST simple en http://localhost:8080.

Endpoints Principales


🚀 Inicio Rápido — Linux / macOS

Instalación en Una Línea

root@kitploit:~
curl -fsSL https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.sh | bash

Después de la Instalación — Configuración Completa

root@kitploit:~
# Paso 1 — Cargar la extensión en Brave:
# brave://extensions → Modo desarrollador ACTIVADO → Cargar descomprimida
# → seleccionar: ~/.scrapper/extension/brave/

# Paso 2 — Registrar tu ID de extensión
scrapper-register-ext TU_ID_DE_EXTENSIÓN

# Paso 3 — Iniciar SCRAPPER
scrapper-start

# Paso 4 — Abrir el panel
# http://localhost:8080

Requisitos

  • Python 3 (cualquier versión reciente)
  • Bun o Node.js (para el panel de Bun — opcional)
  • Navegador Brave / Chrome / Firefox

Configuración Manual

root@kitploit:~
# Clonar el repositorio
git clone https://github.com/BunElysiaReact/SCRAPY.git ~/scrapper
cd ~/scrapper

# Compilar el host nativo en C
gcc -O2 -o linux/c_core/native_host/debug_host linux/c_core/native_host/debug_host.c -lpthread

# Compilar el motor de selección en Rust
cd linux/rust_finder && cargo build --release && cd ../..

# Iniciar el servidor API
cd linux/python_api && python3 api.py

Abre http://localhost:8080 → Panel listo.


🪟 Inicio Rápido — Windows

Instalación en Una Línea (PowerShell)

root@kitploit:~
irm https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.ps1 | iex

⚠️ Ejecuta PowerShell como Administrador para que el registro de mensajería nativa funcione correctamente.

Estructura de Carpetas en Windows Después de la Instalación

root@kitploit:~
%USERPROFILE%\.scrapper\
├── bin\
│   ├── debug_host.exe         ← Host de mensajería nativa en C
│   ├── scraper_cli.exe        ← Cliente CLI
│   ├── rust_finder.exe        ← Motor rápido de selectores HTML
│   ├── scrapper-start.bat     ← Iniciar todo
│   └── scrapper-stop.bat      ← Detener todo
├── data\                      ← Todos los datos de sesión capturados
├── logs\                      ← Registros del host
├── python_api\
│   └── api.py                 ← Servidor API REST
├── extension\
│   ├── brave\                 ← Cargar en Brave / Chrome / Edge
│   └── firefox\               ← Cargar en Firefox
└── ui\scrapperui\             ← Código fuente del panel

🧩 Extensiones de Navegador

Brave y Chrome (Recomendado)

  1. Abre brave://extensions o chrome://extensions
  2. Activa Modo desarrollador (esquina superior derecha)
  3. Haz clic en Cargar descomprimida
  4. Selecciona: ~/.scrapper/extension/brave/
  5. Copia el ID de la extensión
  6. Ejecuta: scrapper-register-ext TU_ID

Microsoft Edge

Igual que Brave/Chrome — Edge está basado en Chromium, usa la carpeta extension/brave/.

Firefox

  1. Abre about:debugging → Este Firefox
  2. Haz clic en Cargar complemento temporal...
  3. Selecciona: ~/.scrapper/extension/firefox/manifest.json

⚠️ Firefox captura cookies, encabezados, localStorage — pero no los cuerpos de las solicitudes a nivel CDP.


🔧 Usar Datos Capturados en tus Herramientas

Python + curl_cffi (Recomendado)

root@kitploit:~
from curl_cffi import requests

API = "http://localhost:8080"
domain = "example.com"

cookies_raw = requests.get(f"{API}/api/v1/session/cookies?domain={domain}").json()
fp = requests.get(f"{API}/api/v1/fingerprint?domain={domain}").json()

session = requests.Session(impersonate="chrome120")
for c in cookies_raw:
    session.cookies.set(c["name"], c["value"], domain=c.get("domain", domain).lstrip("."))
session.headers.update({"User-Agent": fp.get("userAgent", "")})

response = session.get(f"https://{domain}/api/data")
print(response.json())

Python requests

root@kitploit:~
import requests

session_data = requests.get('http://localhost:8080/api/v1/session/all').json()

s = requests.Session()
s.cookies.update({c['name']: c['value'] for c in session_data['cookies']})
s.headers.update({'User-Agent': session_data['fingerprint']['userAgent']})

response = s.get('https://api.example.com/data')

curl

root@kitploit:~
source <(curl -s http://localhost:8080/api/v1/export/env)

curl -X POST "https://api.example.com/upload" \
  -H "Authorization: Bearer $SCRAPPER_BEARER_TOKEN" \
  -b "$SCRAPPER_COOKIES" \
  -F "[email protected]"

Playwright (Python)

root@kitploit:~
import requests
from playwright.async_api import async_playwright

session = requests.get('http://localhost:8080/api/v1/session/all').json()

async with async_playwright() as p:
    context = await p.chromium.launch_persistent_context(
        user_data_dir="./profile",
        user_agent=session['fingerprint']['userAgent'],
    )
    await context.add_cookies(session['cookies'])
    page = await context.new_page()
    await page.goto('https://example.com')

Puppeteer (Node.js)

root@kitploit:~
const session = await fetch('http://localhost:8080/api/v1/session/all').then(r => r.json());

const browser = await puppeteer.launch();
const page = await browser.newPage();
await page.setCookie(...session.cookies);
await page.setUserAgent(session.fingerprint.userAgent);
await page.goto('https://example.com/dashboard');

📊 Resumen del Panel

Panel en vivo de SCRAPPER

Abre http://localhost:8080:


⚠️ Expectativas Realistas

Lo Que SCRAPPER PUEDE Hacer

  • ✅ Capturar tus COOKIES, TOKENS y HUELLA reales
  • ✅ Guardarlos para reutilización (días a meses dependiendo del sitio)
  • ✅ Exportar en formatos JSON, JSONL, HAR, CSV, TXT
  • ✅ Servir todo a través de una API REST local limpia
  • ✅ Ayudarte a entender cómo funcionan realmente los sitios a nivel de red

Lo Que SCRAPPER NO PUEDE Hacer

  • ❌ Raspar sitios web automáticamente sin que tú navegues primero
  • ❌ Adivinar cómo se ven las cookies o los tokens
  • ❌ Extender la vida útil de las cookies más allá de lo que permite el sitio
  • ❌ Funcionar sin el host nativo y la extensión en ejecución

🏭 Uso en Producción y Automatización

root@kitploit:~
# Exportar los datos de sesión más recientes
curl -s "http://localhost:8080/api/v1/bulk/all?format=jsonl" > session.jsonl

# Usar en tu scraper
python3 my-scraper.py --session session.jsonl
root@kitploit:~
# session_refresh.py — Proceso de actualización semanal de sesión
import requests, schedule, time

def refresh_session():
    notify_user("Por favor, inicia sesión en los sitios objetivo en tu navegador")
    time.sleep(300)  # 5 minutos para que el usuario navegue
    data = requests.get('http://localhost:8080/api/v1/bulk/all?format=json').json()
    with open(f'session_{int(time.time())}.json', 'w') as f:
        import json; json.dump(data, f)

schedule.every().monday.at("09:00").do(refresh_session)
while True:
    schedule.run_pending()
    time.sleep(60)

🛠️ Estado de Implementación

Actual (v2.1.0)

  • ✅ Captura de solicitudes/respuestas/cuerpos (Brave/Chrome vía CDP)
  • ✅ Seguimiento de cookies (todos los navegadores)
  • ✅ Instantáneas DOM y pruebas de selectores
  • ✅ Extracción de tokens Bearer y tokens de tarea
  • ✅ Captura de huella del navegador
  • ✅ Feed de eventos en vivo (SSE)
  • ✅ Exportación masiva (JSON/JSONL/TXT/HAR/CSV)
  • ✅ Cola de URL con retardos similares a humanos
  • ✅ "Copiar para LLM" en cada solicitud y endpoint
  • ✅ Extensiones para Brave, Chrome, Edge, Firefox
  • ✅ Instaladores para Linux y Windows

Próximamente

  • 🔜 Listado en Chrome Web Store
  • 🔜 Listado en Firefox Add-ons (firmado)
  • 🔜 Captura de tramas WebSocket
  • 🔜 Compartir sesión entre máquinas

🤝 Contribuir

Abre un issue


🙏 Construido Con

  • BertUI React Framework — Interfaz de usuario del panel
  • Bun + ElysiaJS — Entorno de ejecución JavaScript rápido
  • Rust + crate scraper — Motor de selectores CSS ultrarrápido
  • C — Host de mensajería nativa de latencia ultra baja (Linux)
  • C + WinAPI — Host de mensajería nativa (named pipes de Windows)
  • Python 3 — Servidor API REST sin dependencias

SCRAPPER de BertUI — El Observador de Sesiones para Automatización Web
🔍 Observando tu navegador para que tú no tengas que hacerlo

⭐ Dale estrella al repo si SCRAPPER te ayuda — ¡ayuda a otros a encontrarlo!

Descargar herramienta
DesafíoPor Qué Es Difícil
AutenticaciónProgramar manualmente inicios de sesión para cada sitio es tedioso y frágil
Estado de sesiónLas cookies caducan, los tokens rotan, localStorage se limpia
Ingeniería inversaHoras en DevTools entendiendo patrones de API
Detección de botsHuellas TLS, entropía del navegador, Cloudflare, hCaptcha
Complejidad de configuraciónPelear con navegadores headless, proxies y complementos de sigilo
SCRAPPER ES...SCRAPPER NO ES...
🔍 Un observador de sesiones que observa TU navegador real❌ Un reemplazo de Puppeteer/Playwright/Selenium
💾 Una herramienta de captura de datos que guarda tu sesión real❌ Una herramienta que raspa sitios web por ti
📡 Un servidor API local que sirve tus datos capturados❌ Un servicio alojado o plataforma en la nube
🧠 Un asistente de ingeniería inversa que revela APIs ocultas❌ Un botón mágico de "raspa cualquier cosa"
🎯 Un depurador visual para entender la estructura del sitio❌ Un constructor de automatización sin código
VentajaPor Qué Importa
Omite la Detección Avanzada de BotsUsa curl_cffi para suplantar la huella TLS de un navegador real (ej. Chrome 120) — no es marcado como automatizado
Tasa de Éxito del 97%Apunta a rutas API internas, no a la interfaz visual — inmune a cambios de CSS, botones móviles o cambios de diseño
Bajo Uso de Recursos~20MB RAM vs 500MB+ de Puppeteer/Selenium. Sin motor de navegador en ejecución
Autenticación InvisibleSe aprovecha de tu sesión existente verificada por humano — sin flujo de inicio de sesión, sin CAPTCHAs
Sincronización con Navegador RealLos mensajes/acciones de los scripts aparecen en tu pestaña real del navegador cuando actualizas
Independiente del LenguajeLa API de sesión funciona con Python, Go, Rust, Node, curl — cualquier cosa que pueda hacer solicitudes HTTP
DesventajaQué Significa
Vida de Sesión FrágilDepende completamente de una sesión de navegador activa — caduca si cierras sesión
Depende de APIs InternasUsa endpoints no documentados que pueden cambiar sin previo aviso
Requiere Infraestructura de ConfiguraciónNo es independiente — necesita el host nativo y la extensión del navegador ejecutándose simultáneamente
Riesgo de CuentaUsa tu identidad real. Golpear agresivamente los límites de tasa puede hacer que tu cuenta real sea baneada
Curva de AprendizajeDebes leer el tráfico de red para entender los payloads correctos de la API
Vinculación a un Solo Dispositivodevice-id está ligado a una sesión capturada — no se puede compartir fácilmente entre máquinas
EndpointDescripción
GET /api/v1/session/cookies?domain=example.comTodas las cookies de un dominio
GET /api/v1/session/localstorage?domain=example.comDatos de localStorage
GET /api/v1/session/allVolcado completo de la sesión
GET /api/v1/fingerprintHuella del navegador
GET /api/v1/tokens/allTodos los tokens extraídos
GET /api/v1/requests/recent?limit=50Solicitudes de red recientes
GET /api/v1/dom/snapshot?url=example.comInstantánea DOM
GET /api/v1/export/envFormato de variables de entorno
GET /api/v1/bulk/all?format=[json|jsonl|har|csv|txt]Todo, a tu formato
PestañaQué Hace
LiveTransmisión en tiempo real de todos los eventos de red capturados
BodiesCuerpos de respuesta HTTP — JSON, HTML, SVG, imágenes, con vista previa
ResponsesTodas las respuestas HTTP por dominio, filtrables por banderas
IntelResumen por dominio — tokens, cookies, endpoints, mapa DOM
TokensTokens Bearer, tokens de tarea, cookies de autenticación, fragmentos curl
EndpointsTodos los endpoints de API descubiertos con "Copiar para LLM"
DOM MapÁrbol completo de etiquetas/clases/IDs — haz clic en cualquier elemento para rasparlo automáticamente
FindPrueba selectores CSS contra HTML real renderizado
NavNavega + rastrea pestañas, descarga cookies, captura HTML
QueueProcesa lotes de listas de URLs con retardos configurables
ÁreaLo Que Se Necesita
PruebasPrueba SCRAPPER en diferentes sitios, reporta errores
FirefoxAyuda a mejorar las soluciones CDP de la extensión de Firefox
WindowsPrueba los casos límite del instalador de Windows
DocsEscribe tutoriales para sitios o casos de uso específicos
CódigoPRs bienvenidos — especialmente correcciones de errores