Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
SCRAPPER — Web-Scraping leicht gemacht | Kitploit
Tools/GitHubGitHub/bunelysiareact/scrapper
OSINT (Open-Source-Intelligence)AufklärungReverse EngineeringAPI-SicherheitstestsDebuggerInformationsbeschaffungWebsicherheitPenetrationstestsCrawler
GitHubbunelysiareact/scrapper

SCRAPPER

Web-Scraping leicht gemacht

134vor 5 MonatenNoch nicht geprüft

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
Teilen
Repository anzeigen
Webseite

🕷️ SCRAPPER von BertUI

Der Session Observer für Webautomatisierung

SCRAPPER ist kein Scraper – es ist ein SESSION OBSERVER, der Ihre echten Browserdaten erfasst und für jedes Automatisierungstool bereitstellt.
Basierend auf dem BertUI React Framework
GitHub: BunElysiaReact/SCRAPY
Keine Domain. Keine Cloud. Alles lokal. Alles Ihnen.

SCRAPPER Dashboard


📋 Inhaltsverzeichnis

  • Das Problem, das SCRAPPER löst
  • Was SCRAPPER ist (und nicht ist)
  • Wie SCRAPPER funktioniert
  • Was SCRAPPER erfasst
  • Vorteile & Nachteile
  • Universelle Daten-API
  • Schnellstart – Linux / macOS
  • Schnellstart – Windows
  • Browser-Erweiterungen
  • Erfasste Daten in Ihren Tools nutzen
  • Dashboard-Übersicht
  • Produktionseinsatz & Automatisierung
  • Mitwirken

🤔 Das Problem, das SCRAPPER löst

Jedes Webautomatisierungstool – Puppeteer, Playwright, Selenium, sogar curl – hat die gleichen Herausforderungen:

Das eigentliche Problem: All diese Tools versuchen, einen Menschen nachzuahmen. Aber sie raten, wie ein echter Mensch aussieht.


💡 Was SCRAPPER ist (und nicht ist)

SCRAPPER scraped nicht. Es gibt Ihnen die ECHTEN Daten, die SIE für erfolgreiches Scraping brauchen.


🔄 Wie SCRAPPER funktioniert

Phase 1: Erfassung (Browser offen, Sie surfen)

root@kitploit:~
SIE                                              SCRAPPER
  │                                                  │
  ├── Brave/Chrome/Firefox mit Erweiterung öffnen ────►│
  │                                                  │
  ├── In Websites einloggen, die Sie automatisieren ──►│ erfasst:
  │                                                  │  • Cookies
  ├── Normal surfen, auf Schaltflächen klicken ───────►│  • Tokens
  │                                                  │  • Fingerprint
  └── Surfen beendet ─────────────────────────────────►│  • API-Anfragen
                                                     │  • DOM-Struktur

Phase 2: Automatisierung (Browser kann schließen, Sie programmieren)

root@kitploit:~
IHR SKRIPT ──── GET /api/v1/session/all ────► SCRAPPER API (localhost:8080)
              ◄── { cookies, tokens, fingerprint } ────────────────────────┘
                │
                ▼
         Puppeteer / Playwright / Selenium / Python requests / curl
                │
                ▼
         ✅ Authentifizierte Anfragen mit IHRER echten Session

🎬 In Aktion sehen

Das Dashboard – 258 erfasste claude.ai-Anfragen

SCRAPPER Dashboard Responses

Das Erweiterungs-Popup – Live-Feed, Schnellerfassung, Echtzeit-Statistiken

SCRAPPER Erweiterung

Der Installer – Ein Befehl, 5 Schritte, erledigt

SCRAPPER Installer

Erweiterungs-ID registrieren – Ein Befehl nach dem Laden der Erweiterung

Erweiterung registrieren

Praxisbeispiel – Mit Claude.ai vom Terminal aus via SCRAPPER sprechen

Claude Chat via SCRAPPER

Das obige Skript hat mit SCRAPPER eine echte claude.ai-Session erfasst und dann Nachrichten direkt über die API gesendet – null Login-Code, null Puppeteer, null Browser-Automatisierung.


📦 Was SCRAPPER erfasst

root@kitploit:~
📦 Session-Daten
   ├── 🍪 Cookies (einschließlich HttpOnly, Secure, alle Domains)
   ├── 💾 localStorage & sessionStorage
   ├── 🔑 Auth-Tokens (Bearer, JWT, CSRF, benutzerdefiniert)
   └── 📨 Alle HTTP-Header

🖥️ Browser-Fingerprint
   ├── 📱 User-Agent
   ├── 🖼️ Bildschirmauflösung & Farbtiefe
   ├── 🌍 Zeitzone & Spracheinstellungen
   └── 📨 Vollständiger Headersatz (Accept, Accept-Language usw.)

📡 Netzwerkverkehr
   ├── 📤 Alle HTTP-Anfragen (URLs, Methoden, Header, POST-Daten)
   ├── 📥 Alle HTTP-Antworten (Status, Header, Bodies)
   └── 🔄 WebSocket-Frames

🌳 DOM-Zustand
   ├── 📄 DOM-Schnappschüsse
   ├── 🎯 Live-Selektor-Tests
   └── 🗺️ DOM-Karten (alle Tags, Klassen, IDs)

⚖️ Vorteile & Nachteile

✅ Vorteile

❌ Nachteile


📡 Universelle Daten-API

Nach der Erfassung stellt SCRAPPER alles über eine einfache REST-API unter http://localhost:8080 bereit.

Kern-Endpunkte


🚀 Schnellstart – Linux / macOS

Einzeilige Installation

root@kitploit:~
curl -fsSL https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.sh | bash

Nach der Installation – Vollständiges Setup

root@kitploit:~
# Schritt 1 – Erweiterung in Brave laden:
# brave://extensions → Entwicklermodus EIN → Entpackte Erweiterung laden
# → auswählen: ~/.scrapper/extension/brave/

# Schritt 2 – Ihre Erweiterungs-ID registrieren
scrapper-register-ext IHRE_ERWEITERUNGS_ID

# Schritt 3 – SCRAPPER starten
scrapper-start

# Schritt 4 – Dashboard öffnen
# http://localhost:8080

Voraussetzungen

  • Python 3 (beliebige aktuelle Version)
  • Bun oder Node.js (für das Bun-Dashboard – optional)
  • Brave / Chrome / Firefox-Browser

Manuelles Setup

root@kitploit:~
# Repository klonen
git clone https://github.com/BunElysiaReact/SCRAPY.git ~/scrapper
cd ~/scrapper

# C Native Host bauen
gcc -O2 -o linux/c_core/native_host/debug_host linux/c_core/native_host/debug_host.c -lpthread

# Rust-Selektor-Engine bauen
cd linux/rust_finder && cargo build --release && cd ../..

# API-Server starten
cd linux/python_api && python3 api.py

Öffnen Sie http://localhost:8080 → Dashboard bereit.


🪟 Schnellstart – Windows

Einzeilige Installation (PowerShell)

root@kitploit:~
irm https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.ps1 | iex

⚠️ Führen Sie PowerShell als Administrator aus, damit die native Messaging-Registrierung korrekt funktioniert.

Windows-Ordnerstruktur nach der Installation

root@kitploit:~
%USERPROFILE%\.scrapper\
├── bin\
│   ├── debug_host.exe         ← C Native Messaging Host
│   ├── scraper_cli.exe        ← CLI-Client
│   ├── rust_finder.exe        ← Schnelle HTML-Selektor-Engine
│   ├── scrapper-start.bat     ← Alles starten
│   └── scrapper-stop.bat      ← Alles stoppen
├── data\                      ← Alle erfassten Session-Daten
├── logs\                      ← Host-Protokolle
├── python_api\
│   └── api.py                 ← REST-API-Server
├── extension\
│   ├── brave\                 ← In Brave / Chrome / Edge laden
│   └── firefox\               ← In Firefox laden
└── ui\scrapperui\             ← Dashboard-Quellcode

🧩 Browser-Erweiterungen

Brave & Chrome (Empfohlen)

  1. Öffnen Sie brave://extensions oder chrome://extensions
  2. Aktivieren Sie Entwicklermodus (oben rechts)
  3. Klicken Sie auf Entpackte Erweiterung laden
  4. Wählen Sie: ~/.scrapper/extension/brave/
  5. Kopieren Sie die Erweiterungs-ID
  6. Führen Sie aus: scrapper-register-ext IHRE_ID

Microsoft Edge

Gleich wie Brave/Chrome – Edge basiert auf Chromium, verwenden Sie den Ordner extension/brave/.

Firefox

  1. Öffnen Sie about:debugging → Dieses Firefox
  2. Klicken Sie auf Temporäres Add-on laden...
  3. Wählen Sie: ~/.scrapper/extension/firefox/manifest.json

⚠️ Firefox erfasst Cookies, Header, localStorage – aber keine CDP-Anfragekörper.


🔧 Erfasste Daten in Ihren Tools nutzen

Python + curl_cffi (Empfohlen)

root@kitploit:~
from curl_cffi import requests

API = "http://localhost:8080"
domain = "example.com"

cookies_raw = requests.get(f"{API}/api/v1/session/cookies?domain={domain}").json()
fp = requests.get(f"{API}/api/v1/fingerprint?domain={domain}").json()

session = requests.Session(impersonate="chrome120")
for c in cookies_raw:
    session.cookies.set(c["name"], c["value"], domain=c.get("domain", domain).lstrip("."))
session.headers.update({"User-Agent": fp.get("userAgent", "")})

response = session.get(f"https://{domain}/api/data")
print(response.json())

Python requests

root@kitploit:~
import requests

session_data = requests.get('http://localhost:8080/api/v1/session/all').json()

s = requests.Session()
s.cookies.update({c['name']: c['value'] for c in session_data['cookies']})
s.headers.update({'User-Agent': session_data['fingerprint']['userAgent']})

response = s.get('https://api.example.com/data')

curl

root@kitploit:~
source <(curl -s http://localhost:8080/api/v1/export/env)

curl -X POST "https://api.example.com/upload" \
  -H "Authorization: Bearer $SCRAPPER_BEARER_TOKEN" \
  -b "$SCRAPPER_COOKIES" \
  -F "[email protected]"

Playwright (Python)

root@kitploit:~
import requests
from playwright.async_api import async_playwright

session = requests.get('http://localhost:8080/api/v1/session/all').json()

async with async_playwright() as p:
    context = await p.chromium.launch_persistent_context(
        user_data_dir="./profile",
        user_agent=session['fingerprint']['userAgent'],
    )
    await context.add_cookies(session['cookies'])
    page = await context.new_page()
    await page.goto('https://example.com')

Puppeteer (Node.js)

root@kitploit:~
const session = await fetch('http://localhost:8080/api/v1/session/all').then(r => r.json());

const browser = await puppeteer.launch();
const page = await browser.newPage();
await page.setCookie(...session.cookies);
await page.setUserAgent(session.fingerprint.userAgent);
await page.goto('https://example.com/dashboard');

📊 Dashboard-Übersicht

SCRAPPER Live-Dashboard

Öffnen Sie http://localhost:8080:


⚠️ Realistische Erwartungen

Was SCRAPPER KANN

  • ✅ Ihre ECHTEN Cookies, Tokens und Fingerprint erfassen
  • ✅ Für die Wiederverwendung speichern (Tage bis Monate, je nach Website)
  • ✅ In den Formaten JSON, JSONL, HAR, CSV, TXT exportieren
  • ✅ Über eine saubere lokale REST-API bereitstellen
  • ✅ Ihnen helfen zu verstehen, wie Websites auf Netzwerkebene wirklich funktionieren

Was SCRAPPER NICHT KANN

  • ❌ Websites automatisch scrapen, ohne dass Sie vorher surfen
  • ❌ Erraten, wie Cookies oder Tokens aussehen
  • ❌ Cookie-Lebensdauern über das hinaus verlängern, was die Website erlaubt
  • ❌ Ohne laufenden nativen Host und Erweiterung funktionieren

🏭 Produktionseinsatz & Automatisierung

root@kitploit:~
# Neueste Session-Daten exportieren
curl -s "http://localhost:8080/api/v1/bulk/all?format=jsonl" > session.jsonl

# In Ihrem Scraper verwenden
python3 my-scraper.py --session session.jsonl
root@kitploit:~
# session_refresh.py – Wöchentliche Session-Aktualisierungspipeline
import requests, schedule, time

def refresh_session():
    notify_user("Bitte loggen Sie sich in Ihrem Browser in die Ziel-Websites ein")
    time.sleep(300)  # 5 Minuten für den Benutzer zum Surfen
    data = requests.get('http://localhost:8080/api/v1/bulk/all?format=json').json()
    with open(f'session_{int(time.time())}.json', 'w') as f:
        import json; json.dump(data, f)

schedule.every().monday.at("09:00").do(refresh_session)
while True:
    schedule.run_pending()
    time.sleep(60)

🛠️ Implementierungsstatus

Aktuell (v2.1.0)

  • ✅ Anfrage-/Antwort-/Körpererfassung (Brave/Chrome via CDP)
  • ✅ Cookie-Tracking (alle Browser)
  • ✅ DOM-Schnappschüsse und Selektor-Tests
  • ✅ Bearer-Token- und Task-Token-Extraktion
  • ✅ Browser-Fingerprint-Erfassung
  • ✅ Live-Ereignis-Feed (SSE)
  • ✅ Bulk-Export (JSON/JSONL/TXT/HAR/CSV)
  • ✅ URL-Warteschlange mit menschlichen Verzögerungen
  • ✅ "Für LLM kopieren" bei jeder Anfrage und jedem Endpunkt
  • ✅ Brave-, Chrome-, Edge-, Firefox-Erweiterungen
  • ✅ Linux- und Windows-Installer

Demnächst

  • 🔜 Chrome Web Store-Eintrag
  • 🔜 Firefox Add-ons-Eintrag (signiert)
  • 🔜 WebSocket-Frame-Erfassung
  • 🔜 Session-Freigabe zwischen Geräten

🤝 Mitwirken

Ein Issue eröffnen


🙏 Erstellt mit

  • BertUI React Framework – Dashboard-Benutzeroberfläche
  • Bun + ElysiaJS – Schnelle JavaScript-Laufzeit
  • Rust + scraper crate – Blitzschnelle CSS-Selektor-Engine
  • C – Ultra-niedrige Latenz für nativen Messaging-Host (Linux)
  • C + WinAPI – Nativer Messaging-Host (Windows Named Pipes)
  • Python 3 – REST-API-Server ohne Abhängigkeiten

SCRAPPER von BertUI – Der Session Observer für Webautomatisierung
🔍 Ihren Browser beobachten, damit Sie es nicht müssen

⭐ Star das Repository, wenn SCRAPPER Ihnen hilft – es hilft anderen, es zu finden!

Tool herunterladen
HerausforderungWarum es schwierig ist
AuthentifizierungManuelles Skripten von Logins für jede Website ist mühsam und fragil
Session-ZustandCookies laufen ab, Tokens rotieren, localStorage wird gelöscht
Reverse EngineeringStunden in den DevTools, um API-Muster zu verstehen
Bot-ErkennungTLS-Fingerabdrücke, Browser-Entropie, Cloudflare, hCaptcha
Setup-KomplexitätKampf mit Headless-Browsern, Proxys und Stealth-Plugins
SCRAPPER IST...SCRAPPER IST NICHT...
🔍 Ein Session Observer, der IHREN echten Browser beobachtet❌ Ein Ersatz für Puppeteer/Playwright/Selenium
💾 Ein Datenerfassungstool, das Ihre tatsächliche Session speichert❌ Ein Tool, das Websites für Sie scraped
📡 Ein lokaler API-Server, der Ihre erfassten Daten bereitstellt❌ Ein gehosteter Dienst oder eine Cloud-Plattform
🧠 Ein Reverse-Engineering-Assistent, der versteckte APIs offenlegt❌ Ein magischer "Scrape alles"-Knopf
🎯 Ein visueller Debugger zum Verständnis der Seitenstruktur❌ Ein No-Code-Automatisierungs-Builder
VorteilWarum es wichtig ist
Umgeht erweiterte Bot-ErkennungVerwendet curl_cffi, um den TLS-Fingerabdruck eines echten Browsers zu imitieren (z. B. Chrome 120) – wird nicht als automatisiert erkannt
97% ErfolgsquoteZiel sind interne API-Routen, nicht die visuelle Benutzeroberfläche – immun gegen CSS-Änderungen, bewegliche Schaltflächen oder Layout-Updates
Geringer Ressourcenverbrauch~20 MB RAM vs. 500 MB+ bei Puppeteer/Selenium. Keine Browser-Engine läuft
Unsichtbare AuthentifizierungNutzt Ihre vorhandene, vom Menschen verifizierte Session – kein Login-Flow, keine CAPTCHAs
Synchronisiert mit echtem BrowserNachrichten/Aktionen aus Skripten erscheinen in Ihrem echten Browser-Tab, wenn Sie aktualisieren
SprachunabhängigSession-API funktioniert mit Python, Go, Rust, Node, curl – alles, was HTTP-Anfragen stellen kann
NachteilWas es bedeutet
Spröde Session-LebensdauerVollständig abhängig von einer aktiven Browser-Session – läuft ab, wenn Sie sich ausloggen
Abhängig von internen APIsVerwendet undokumentierte Endpunkte, die sich ohne Vorankündigung ändern können
Erfordert Setup-InfrastrukturNicht eigenständig – benötigt nativen Host und Browser-Erweiterung gleichzeitig
KontorisikoVerwendet Ihre echte Identität. Aggressives Raten-Limit kann zu einem echten Kontobann führen
LernkurveNetzwerkverkehr muss gelesen werden, um die korrekten API-Payloads zu verstehen
Einzelgerätebindungdevice-id ist an eine erfasste Session gebunden – nicht einfach zwischen Geräten teilbar
EndpunktBeschreibung
GET /api/v1/session/cookies?domain=example.comAlle Cookies für eine Domain
GET /api/v1/session/localstorage?domain=example.comlocalStorage-Daten
GET /api/v1/session/allVollständiger Session-Dump
GET /api/v1/fingerprintBrowser-Fingerprint
GET /api/v1/tokens/allAlle extrahierten Tokens
GET /api/v1/requests/recent?limit=50Neueste Netzwerkanfragen
GET /api/v1/dom/snapshot?url=example.comDOM-Schnappschuss
GET /api/v1/export/envUmgebungsvariablen-Format
GET /api/v1/bulk/all?format=[json|jsonl|har|csv|txt]Alles, Ihr Format
TabFunktion
LiveEchtzeit-Stream aller erfassten Netzwerkereignisse
BodiesHTTP-Antwortkörper – JSON, HTML, SVG, Bilder, mit Vorschau
ResponsesAlle HTTP-Antworten nach Domain, filterbar nach Flags
IntelZusammenfassung pro Domain – Tokens, Cookies, Endpunkte, DOM-Karte
TokensBearer-Tokens, Task-Tokens, Auth-Cookies, curl-Snippets
EndpointsAlle entdeckten API-Endpunkte mit "Für LLM kopieren"
DOM MapVollständiger Tag-/Klassen-/ID-Baum – Klick auf ein Element zum automatischen Scrapen
FindCSS-Selektoren gegen echtes gerendertes HTML testen
NavNavigieren + Tabs verfolgen, Cookies dumpen, HTML erfassen
QueueStapelverarbeitung von URL-Listen mit konfigurierbaren Verzögerungen
BereichWas wird benötigt
TestenSCRAPPER auf verschiedenen Websites ausprobieren, Fehler melden
FirefoxHelfen, Firefox-Erweiterungs-Workarounds für CDP zu verbessern
WindowsWindows-Installer-Randfälle testen
DokumentationTutorials für bestimmte Websites oder Anwendungsfälle schreiben
CodePull-Requests willkommen – insbesondere Fehlerbehebungen