Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
SCRAPPER — Scrap a maneira web para fácil | Kitploit
Ferramentas/GitHubGitHub/bunelysiareact/scrapper
OSINT (Inteligência de Fontes Abertas)ReconhecimentoEngenharia ReversaTestes de Segurança de APIsDepuradoresColeta de InformaçõesSegurança WebTestes de PenetraçãoRastreador
GitHubbunelysiareact/scrapper

SCRAPPER

Scrap a maneira web para fácil

134há 5 mesesAinda não revisado

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar
Ver Repositório
Site

🕷️ SCRAPPER por BertUI

O Observador de Sessão para Automação Web

SCRAPPER não é um scraper — é um OBSERVADOR DE SESSÃO que captura os dados reais do seu navegador para uso em qualquer ferramenta de automação.
Construído sobre o BertUI React Framework
GitHub: BunElysiaReact/SCRAPY
Sem domínio. Sem nuvem. Tudo local. Tudo seu.

Painel do SCRAPPER


📋 Índice

  • O Problema que o SCRAPPER Resolve
  • O Que o SCRAPPER É (E Não É)
  • Como o SCRAPPER Funciona
  • O Que o SCRAPPER Captura
  • Vantagens e Desvantagens
  • API de Dados Universal
  • Início Rápido — Linux / macOS
  • Início Rápido — Windows
  • Extensões de Navegador
  • Usando Dados Capturados em Suas Ferramentas
  • Visão Geral do Painel
  • Uso em Produção e Automação
  • Contribuindo

🤔 O Problema que o SCRAPPER Resolve

Toda ferramenta de automação web — Puppeteer, Playwright, Selenium, até curl — compartilha os mesmos desafios:

O verdadeiro problema: Todas essas ferramentas tentam imitar um humano. Mas elas estão adivinhando como um humano real se parece.


💡 O Que o SCRAPPER É (E Não É)

SCRAPPER não raspa. Ele fornece os dados REAIS de que VOCÊ precisa para raspar com sucesso.


🔄 Como o SCRAPPER Funciona

Fase 1: Captura (Navegador Aberto, Você Navega)

root@kitploit:~
VOCÊ                                              SCRAPPER
  │                                                  │
  ├── Abra Brave/Chrome/Firefox com extensão ──────►│
  │                                                  │
  ├── Faça login nos sites que deseja automatizar ──►│ captura:
  │                                                  │  • Cookies
  ├── Navegue normalmente, clique em botões ────────►│  • Tokens
  │                                                  │  • Impressão digital
  └── Termine de navegar ──────────────────────────►│  • Requisições de API
                                                     │  • Estrutura DOM

Fase 2: Automatize (Navegador Pode Fechar, Você Programa)

root@kitploit:~
SEU SCRIPT ──── GET /api/v1/session/all ────► API SCRAPPER (localhost:8080)
              ◄── { cookies, tokens, fingerprint } ────────────────────────┘
                │
                ▼
         Puppeteer / Playwright / Selenium / Python requests / curl
                │
                ▼
         ✅ Requisições autenticadas com SUA sessão real

🎬 Veja em Ação

O Painel — 258 requisições capturadas do claude.ai

Painel do SCRAPPER - Respostas

O Pop-up da Extensão — Feed ao vivo, captura rápida, estatísticas em tempo real

Extensão SCRAPPER

O Instalador — Um comando, 5 passos, pronto

Instalador SCRAPPER

Registrar ID da Extensão — Um comando após carregar a extensão

Registrar Extensão

Exemplo Real — Conversando com o Claude.ai pelo terminal via SCRAPPER

Chat Claude via SCRAPPER

O script acima usou o SCRAPPER para capturar uma sessão real do claude.ai e depois enviou mensagens diretamente pela API — zero código de login, zero Puppeteer, zero automação de navegador.


📦 O Que o SCRAPPER Captura

root@kitploit:~
📦 Dados da Sessão
   ├── 🍪 Cookies (incluindo HttpOnly, Secure, todos os domínios)
   ├── 💾 localStorage & sessionStorage
   ├── 🔑 Tokens de autenticação (Bearer, JWT, CSRF, personalizados)
   └── 📨 Todos os cabeçalhos HTTP

🖥️ Impressão Digital do Navegador
   ├── 📱 User Agent
   ├── 🖼️ Resolução da tela e profundidade de cor
   ├── 🌍 Fuso horário e configurações de idioma
   └── 📨 Conjunto completo de cabeçalhos (Accept, Accept-Language, etc.)

📡 Tráfego de Rede
   ├── 📤 Todas as requisições HTTP (URLs, métodos, cabeçalhos, dados POST)
   ├── 📥 Todas as respostas HTTP (status, cabeçalhos, corpos)
   └── 🔄 Frames WebSocket

🌳 Estado do DOM
   ├── 📄 Instantâneos do DOM
   ├── 🎯 Teste de seletores ao vivo
   └── 🗺️ Mapas DOM (todas as tags, classes, IDs)

⚖️ Vantagens e Desvantagens

✅ Vantagens

❌ Desvantagens


📡 API de Dados Universal

Uma vez capturado, o SCRAPPER serve tudo através de uma simples API REST em http://localhost:8080.

Endpoints Principais


🚀 Início Rápido — Linux / macOS

Instalação em Uma Linha

root@kitploit:~
curl -fsSL https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.sh | bash

Após a Instalação — Configuração Completa

root@kitploit:~
# Passo 1 — Carregar extensão no Brave:
# brave://extensions → Modo desenvolvedor ATIVADO → Carregar expandida
# → selecione: ~/.scrapper/extension/brave/

# Passo 2 — Registrar seu ID de extensão
scrapper-register-ext SEU_ID_DE_EXTENSÃO

# Passo 3 — Iniciar SCRAPPER
scrapper-start

# Passo 4 — Abrir painel
# http://localhost:8080

Requisitos

  • Python 3 (qualquer versão recente)
  • Bun ou Node.js (para o painel Bun — opcional)
  • Brave / Chrome / Firefox navegador

Configuração Manual

root@kitploit:~
# Clone o repositório
git clone https://github.com/BunElysiaReact/SCRAPY.git ~/scrapper
cd ~/scrapper

# Compile o host nativo C
gcc -O2 -o linux/c_core/native_host/debug_host linux/c_core/native_host/debug_host.c -lpthread

# Compile o motor de seletores Rust
cd linux/rust_finder && cargo build --release && cd ../..

# Inicie o servidor API
cd linux/python_api && python3 api.py

Abra http://localhost:8080 → Painel pronto.


🪟 Início Rápido — Windows

Instalação em Uma Linha (PowerShell)

root@kitploit:~
irm https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.ps1 | iex

⚠️ Execute o PowerShell como Administrador para que o registro de mensagens nativas funcione corretamente.

Estrutura de Pastas no Windows Após a Instalação

root@kitploit:~
%USERPROFILE%\.scrapper\
├── bin\
│   ├── debug_host.exe         ← Host de mensagens nativas C
│   ├── scraper_cli.exe        ← CLI cliente
│   ├── rust_finder.exe        ← Motor rápido de seletores HTML
│   ├── scrapper-start.bat     ← Iniciar tudo
│   └── scrapper-stop.bat      ← Parar tudo
├── data\                      ← Todos os dados de sessão capturados
├── logs\                      ← Logs do host
├── python_api\
│   └── api.py                 ← Servidor da API REST
├── extension\
│   ├── brave\                 ← Carregar no Brave / Chrome / Edge
│   └── firefox\               ← Carregar no Firefox
└── ui\scrapperui\             ← Código fonte do painel

🧩 Extensões de Navegador

Brave & Chrome (Recomendado)

  1. Abra brave://extensions ou chrome://extensions
  2. Ative o Modo desenvolvedor (canto superior direito)
  3. Clique em Carregar expandida
  4. Selecione: ~/.scrapper/extension/brave/
  5. Copie o ID da Extensão
  6. Execute: scrapper-register-ext SEU_ID

Microsoft Edge

Igual ao Brave/Chrome — Edge é baseado em Chromium, use a pasta extension/brave/.

Firefox

  1. Abra about:debugging → Este Firefox
  2. Clique em Carregar Complemento Temporário...
  3. Selecione: ~/.scrapper/extension/firefox/manifest.json

⚠️ O Firefox captura cookies, cabeçalhos, localStorage — mas não corpos de requisição no nível CDP.


🔧 Usando Dados Capturados em Suas Ferramentas

Python + curl_cffi (Recomendado)

root@kitploit:~
from curl_cffi import requests

API = "http://localhost:8080"
domain = "example.com"

cookies_raw = requests.get(f"{API}/api/v1/session/cookies?domain={domain}").json()
fp = requests.get(f"{API}/api/v1/fingerprint?domain={domain}").json()

session = requests.Session(impersonate="chrome120")
for c in cookies_raw:
    session.cookies.set(c["name"], c["value"], domain=c.get("domain", domain).lstrip("."))
session.headers.update({"User-Agent": fp.get("userAgent", "")})

response = session.get(f"https://{domain}/api/data")
print(response.json())

Python requests

root@kitploit:~
import requests

session_data = requests.get('http://localhost:8080/api/v1/session/all').json()

s = requests.Session()
s.cookies.update({c['name']: c['value'] for c in session_data['cookies']})
s.headers.update({'User-Agent': session_data['fingerprint']['userAgent']})

response = s.get('https://api.example.com/data')

curl

root@kitploit:~
source <(curl -s http://localhost:8080/api/v1/export/env)

curl -X POST "https://api.example.com/upload" \
  -H "Authorization: Bearer $SCRAPPER_BEARER_TOKEN" \
  -b "$SCRAPPER_COOKIES" \
  -F "[email protected]"

Playwright (Python)

root@kitploit:~
import requests
from playwright.async_api import async_playwright

session = requests.get('http://localhost:8080/api/v1/session/all').json()

async with async_playwright() as p:
    context = await p.chromium.launch_persistent_context(
        user_data_dir="./profile",
        user_agent=session['fingerprint']['userAgent'],
    )
    await context.add_cookies(session['cookies'])
    page = await context.new_page()
    await page.goto('https://example.com')

Puppeteer (Node.js)

root@kitploit:~
const session = await fetch('http://localhost:8080/api/v1/session/all').then(r => r.json());

const browser = await puppeteer.launch();
const page = await browser.newPage();
await page.setCookie(...session.cookies);
await page.setUserAgent(session.fingerprint.userAgent);
await page.goto('https://example.com/dashboard');

📊 Visão Geral do Painel

Painel ao Vivo do SCRAPPER

Abra http://localhost:8080:


⚠️ Expectativas Realistas

O Que o SCRAPPER PODE FAZER

  • ✅ Capturar seus COOKIES, TOKENS e IMPRESSÃO DIGITAL reais
  • ✅ Salvá-los para reutilização (dias a meses dependendo do site)
  • ✅ Exportar nos formatos JSON, JSONL, HAR, CSV, TXT
  • ✅ Servir tudo através de uma API REST local limpa
  • ✅ Ajudar você a entender como os sites realmente funcionam no nível de rede

O Que o SCRAPPER NÃO PODE FAZER

  • ❌ Raspar sites automaticamente sem você navegar primeiro
  • ❌ Adivinhar como são os cookies ou tokens
  • ❌ Estender a vida útil dos cookies além do que o site permite
  • ❌ Funcionar sem o host nativo e a extensão em execução

🏭 Uso em Produção e Automação

root@kitploit:~
# Exportar dados de sessão mais recentes
curl -s "http://localhost:8080/api/v1/bulk/all?format=jsonl" > session.jsonl

# Usar em seu scraper
python3 my-scraper.py --session session.jsonl
root@kitploit:~
# session_refresh.py — Pipeline de atualização semanal de sessão
import requests, schedule, time

def refresh_session():
    notify_user("Por favor, faça login nos sites alvo em seu navegador")
    time.sleep(300)  # 5 minutos para o usuário navegar
    data = requests.get('http://localhost:8080/api/v1/bulk/all?format=json').json()
    with open(f'session_{int(time.time())}.json', 'w') as f:
        import json; json.dump(data, f)

schedule.every().monday.at("09:00").do(refresh_session)
while True:
    schedule.run_pending()
    time.sleep(60)

🛠️ Status da Implementação

Atual (v2.1.0)

  • ✅ Captura de requisição/resposta/corpo (Brave/Chrome via CDP)
  • ✅ Rastreamento de cookies (todos os navegadores)
  • ✅ Instantâneos DOM e teste de seletores
  • ✅ Extração de token Bearer + token de tarefa
  • ✅ Captura de impressão digital do navegador
  • ✅ Feed de eventos ao vivo (SSE)
  • ✅ Exportação em massa (JSON/JSONL/TXT/HAR/CSV)
  • ✅ Fila de URLs com atrasos humanos
  • ✅ "Copiar para LLM" em cada requisição e endpoint
  • ✅ Extensões para Brave, Chrome, Edge, Firefox
  • ✅ Instaladores Linux + Windows

Em Breve

  • 🔜 Listagem na Chrome Web Store
  • 🔜 Listagem no Firefox Add-ons (assinada)
  • 🔜 Captura de frames WebSocket
  • 🔜 Compartilhamento de sessão entre máquinas

🤝 Contribuindo

Abra uma issue


🙏 Construído Com

  • BertUI React Framework — Interface do painel
  • Bun + ElysiaJS — Runtime JavaScript rápido
  • Rust + crate scraper — Motor de seletores CSS extremamente rápido
  • C — Host de mensagens nativas de latência ultrabaixa (Linux)
  • C + WinAPI — Host de mensagens nativas (pipes nomeados no Windows)
  • Python 3 — Servidor API REST sem dependências

SCRAPPER por BertUI — O Observador de Sessão para Automação Web
🔍 Assistindo seu navegador para que você não precise

⭐ Dê uma estrela no repositório se o SCRAPPER te ajudar — isso ajuda outros a encontrá-lo!

Baixar ferramenta
DesafioPor que é Difícil
AutenticaçãoScriptar logins manualmente para cada site é tedioso e frágil
Estado da sessãoCookies expiram, tokens rotacionam, localStorage é limpo
Engenharia reversaHoras no DevTools entendendo padrões de API
Detecção de botsImpressões digitais TLS, entropia do navegador, Cloudflare, hCaptcha
Complexidade de configuraçãoLutando com navegadores headless, proxies e plugins furtivos
SCRAPPER É...SCRAPPER NÃO É...
🔍 Um observador de sessão que assiste SEU navegador real❌ Um substituto para Puppeteer/Playwright/Selenium
💾 Uma ferramenta de captura de dados que salva sua sessão real❌ Uma ferramenta que raspa sites para você
📡 Um servidor de API local servindo seus dados capturados❌ Um serviço hospedado ou plataforma em nuvem
🧠 Um assistente de engenharia reversa revelando APIs ocultas❌ Um botão mágico "raspe qualquer coisa"
🎯 Um depurador visual para entender a estrutura do site❌ Um construtor de automação sem código
VantagemPor que Importa
Contorna Detecção Avançada de BotsUsa curl_cffi para personificar a impressão digital TLS de um navegador real (ex.: Chrome 120) — não é sinalizado como automatizado
Taxa de Sucesso de 97%Mira rotas internas de API, não a interface visual — imune a mudanças de CSS, botões móveis ou alterações de layout
Baixo Uso de Recursos~20MB de RAM vs 500MB+ para Puppeteer/Selenium. Sem mecanismo de navegador rodando
Autenticação InvisívelAproveita sua sessão existente verificada por humano — sem fluxo de login, sem CAPTCHAs
Sincroniza com o Navegador RealMensagens/ações de scripts aparecem na sua aba real do navegador quando você atualiza
Agnóstico de LinguagemA API da sessão funciona com Python, Go, Rust, Node, curl — qualquer coisa que possa fazer requisições HTTP
DesvantagemO Que Significa
Vida Útil Frágil da SessãoTotalmente dependente de uma sessão ativa do navegador — expira se você sair
Depende de APIs InternasUsa endpoints não documentados que podem mudar sem aviso
Requer Infraestrutura de ConfiguraçãoNão é autônomo — precisa de host nativo + extensão do navegador rodando simultaneamente
Risco de ContaUsa sua identidade real. Atingir limites de taxa agressivamente pode banir sua conta real
Curva de AprendizadoÉ necessário ler o tráfego de rede para entender os payloads corretos da API
Vinculação a um Único Dispositivodevice-id está vinculado a uma sessão capturada — não pode ser facilmente compartilhado entre máquinas
EndpointDescrição
GET /api/v1/session/cookies?domain=example.comTodos os cookies de um domínio
GET /api/v1/session/localstorage?domain=example.comDados de localStorage
GET /api/v1/session/allDespejo completo da sessão
GET /api/v1/fingerprintImpressão digital do navegador
GET /api/v1/tokens/allTodos os tokens extraídos
GET /api/v1/requests/recent?limit=50Requisições de rede recentes
GET /api/v1/dom/snapshot?url=example.comInstantâneo do DOM
GET /api/v1/export/envFormato de variáveis de ambiente
GET /api/v1/bulk/all?format=[json|jsonl|har|csv|txt]Tudo, no seu formato
AbaO Que Faz
Ao VivoFluxo em tempo real de todos os eventos de rede capturados
CorposCorpos de respostas HTTP — JSON, HTML, SVG, imagens, com pré-visualização
RespostasTodas as respostas HTTP por domínio, filtráveis por bandeiras
IntelResumo por domínio — tokens, cookies, endpoints, mapa DOM
TokensTokens Bearer, tokens de tarefa, cookies de autenticação, trechos curl
EndpointsTodos os endpoints de API descobertos com "Copiar para LLM"
Mapa DOMÁrvore completa de tags/classes/IDs — clique em qualquer item para raspar automaticamente
EncontrarTeste seletores CSS contra HTML real renderizado
NavegarNavegar + rastrear abas, despejar cookies, capturar HTML
FilaProcessar em lote listas de URLs com atrasos configuráveis
ÁreaO Que é Necessário
TestesTeste o SCRAPPER em diferentes sites, reporte bugs
FirefoxAjude a melhorar as soluções alternativas de CDP na extensão do Firefox
WindowsTeste casos extremos do instalador do Windows
DocumentaçãoEscreva tutoriais para sites ou casos de uso específicos
CódigoPRs bem-vindos — especialmente correções de bugs