Skip to content
KitploitKITPLOIT
ИнструментыБлог
Отправить
ИнструментыБлог
Отправить

Инструменты для хакинга, пентеста и кибербезопасности — ваш арсенал защиты!

Kitploit — это каталог инструментов для хакинга, кибербезопасности и пентестинга. Находите последние обновления проектов для поиска уязвимостей, анализа систем, автоматизации тестирования и усиления вашей безопасности.

··Ленты·Контакты·Конфиденциальность·© 2026 Kitploit

Каталог инструментов

Категории

Все категории
Loading categories
Инструменты/GitHubGitHub/bunelysiareact/scrapper
OSINT (Разведка открытых источников)РазведкаОбратная инженерияТестирование безопасности APIОтладчикиСбор информацииВеб-безопасностьТестирование на ПроникновениеКраулер
GitHubbunelysiareact/scrapper

SCRAPPER

Скрепите веб простым способом

1345 месяцев назадЕщё не проверено

Популярное

Смотреть все →

Откройте для себя самые используемые инструменты нашего сообщества.

Изучить все инструменты

Просмотрите нашу коллекцию инструментов

Смотреть все инструменты →
Поделиться
Репозиторий
Сайт

🕷️ SCRAPPER от BertUI

Наблюдатель сессий для веб-автоматизации

SCRAPPER — это не скрапер, это НАБЛЮДАТЕЛЬ СЕССИЙ, который захватывает данные вашего реального браузера для использования в любом инструменте автоматизации.
Построен на фреймворке BertUI React
GitHub: BunElysiaReact/SCRAPY
Никаких доменов. Никакого облака. Всё локально. Всё ваше.

SCRAPPER Dashboard


📋 Содержание

  • Проблема, которую решает SCRAPPER
  • Что такое SCRAPPER (и чем он не является)
  • Как работает SCRAPPER
  • Что захватывает SCRAPPER
  • Преимущества и недостатки
  • Универсальный API данных
  • Быстрый старт — Linux / macOS
  • Быстрый старт — Windows
  • Расширения браузера
  • Использование захваченных данных в ваших инструментах
  • Обзор панели управления
  • Использование в production и автоматизация
  • Вклад в проект

🤔 Проблема, которую решает SCRAPPER

Каждый инструмент веб-автоматизации — Puppeteer, Playwright, Selenium, даже curl — сталкивается с одними и теми же трудностями:

Настоящая проблема: Все эти инструменты пытаются имитировать человека. Но они лишь гадают, как выглядит настоящий человек.


💡 Что такое SCRAPPER (и чем он не является)

SCRAPPER не занимается скрапингом. Он даёт вам РЕАЛЬНЫЕ данные, НЕОБХОДИМЫЕ для успешного скрапинга.


🔄 Как работает SCRAPPER

Фаза 1: Захват (браузер открыт, вы просматриваете)

root@kitploit:~
ВЫ                                              SCRAPPER
  │                                                  │
  ├── Открываете Brave/Chrome/Firefox с расширением ──────►│
  │                                                  │
  ├── Входите на сайты, которые хотите автоматизировать ──────►│ захватывает:
  │                                                  │  • Куки
  ├── Обычно просматриваете, нажимаете кнопки ────────────────►│  • Токены
  │                                                  │  • Отпечаток
  └── Завершаете просмотр ─────────────────────────────────►│  • API-запросы
                                                     │  • DOM-структуру

Фаза 2: Автоматизация (браузер можно закрыть, вы пишете код)

root@kitploit:~
ВАШ СКРИПТ ──── GET /api/v1/session/all ────► API SCRAPPER (localhost:8080)
              ◄── { cookies, tokens, fingerprint } ────────────────────────┘
                │
                ▼
         Puppeteer / Playwright / Selenium / Python requests / curl
                │
                ▼
         ✅ Авторизованные запросы с ВАШЕЙ реальной сессией

🎬 Посмотрите в действии

Панель управления — 258 захваченных запросов к claude.ai

SCRAPPER Dashboard Responses

Выпадающее окно расширения — прямая трансляция, быстрый захват, статистика в реальном времени

SCRAPPER Extension

Установщик — одна команда, 5 шагов, готово

SCRAPPER Installer

Регистрация ID расширения — одна команда после загрузки расширения

Register Extension

Реальный пример — общение с Claude.ai из терминала через SCRAPPER

Claude Chat via SCRAPPER

Скрипт выше использовал SCRAPPER для захвата реальной сессии claude.ai, а затем отправлял сообщения напрямую через API — никакого кода для входа, никакого Puppeteer, никакой автоматизации браузера.


📦 Что захватывает SCRAPPER

root@kitploit:~
📦 Данные сессии
   ├── 🍪 Куки (включая HttpOnly, Secure, все домены)
   ├── 💾 localStorage и sessionStorage
   ├── 🔑 Токены аутентификации (Bearer, JWT, CSRF, кастомные)
   └── 📨 Все HTTP-заголовки

🖥️ Отпечаток браузера
   ├── 📱 User Agent
   ├── 🖼️ Разрешение экрана и глубина цвета
   ├── 🌍 Настройки часового пояса и языка
   └── 📨 Полный набор заголовков (Accept, Accept-Language, и т.д.)

📡 Сетевой трафик
   ├── 📤 Все HTTP-запросы (URL, методы, заголовки, POST-данные)
   ├── 📥 Все HTTP-ответы (статус, заголовки, тела)
   └── 🔄 WebSocket-фреймы

🌳 DOM-состояние
   ├── 📄 DOM-снимки
   ├── 🎯 Тестирование селекторов вживую
   └── 🗺️ DOM-карты (все теги, классы, ID)

⚖️ Преимущества и недостатки

✅ Преимущества

❌ Недостатки


📡 Универсальный API данных

После захвата SCRAPPER предоставляет все данные через простой REST API по адресу http://localhost:8080.

Основные конечные точки


🚀 Быстрый старт — Linux / macOS

Установка одной командой

root@kitploit:~
curl -fsSL https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.sh | bash

После установки — полная настройка

root@kitploit:~
# Шаг 1 — Загрузите расширение в Brave:
# brave://extensions → Включить режим разработчика → Загрузить распакованное
# → выберите: ~/.scrapper/extension/brave/

# Шаг 2 — Зарегистрируйте ID расширения
scrapper-register-ext ID_ВАШЕГО_РАСШИРЕНИЯ

# Шаг 3 — Запустите SCRAPPER
scrapper-start

# Шаг 4 — Откройте панель управления
# http://localhost:8080

Требования

  • Python 3 (любая свежая версия)
  • Bun или Node.js (для панели управления на Bun — опционально)
  • Brave / Chrome / Firefox браузер

Ручная установка

root@kitploit:~
# Клонируйте репозиторий
git clone https://github.com/BunElysiaReact/SCRAPY.git ~/scrapper
cd ~/scrapper

# Соберите C-native host
gcc -O2 -o linux/c_core/native_host/debug_host linux/c_core/native_host/debug_host.c -lpthread

# Соберите движок селекторов на Rust
cd linux/rust_finder && cargo build --release && cd ../..

# Запустите API-сервер
cd linux/python_api && python3 api.py

Откройте http://localhost:8080 → Панель управления готова.


🪟 Быстрый старт — Windows

Установка одной командой (PowerShell)

root@kitploit:~
irm https://raw.githubusercontent.com/BunElysiaReact/SCRAPY/main/install.ps1 | iex

⚠️ Запустите PowerShell от имени администратора, чтобы регистрация native messaging работала корректно.

Структура папок Windows после установки

root@kitploit:~
%USERPROFILE%\.scrapper\
├── bin\
│   ├── debug_host.exe         ← C-хост native messaging
│   ├── scraper_cli.exe        ← CLI-клиент
│   ├── rust_finder.exe        ← Быстрый движок HTML-селекторов
│   ├── scrapper-start.bat     ← Запустить всё
│   └── scrapper-stop.bat      ← Остановить всё
├── data\                      ← Все захваченные данные сессий
├── logs\                      ← Логи хоста
├── python_api\
│   └── api.py                 ← REST API-сервер
├── extension\
│   ├── brave\                 ← Загрузить в Brave / Chrome / Edge
│   └── firefox\               ← Загрузить в Firefox
└── ui\scrapperui\             ← Исходный код панели управления

🧩 Расширения браузера

Brave и Chrome (рекомендуется)

  1. Откройте brave://extensions или chrome://extensions
  2. Включите Режим разработчика (правый верхний угол)
  3. Нажмите Загрузить распакованное расширение
  4. Выберите: ~/.scrapper/extension/brave/
  5. Скопируйте ID расширения
  6. Выполните: scrapper-register-ext ВАШ_ID

Microsoft Edge

То же, что и Brave/Chrome — Edge основан на Chromium, используйте папку extension/brave/.

Firefox

  1. Откройте about:debugging → Этот Firefox
  2. Нажмите Загрузить временное дополнение...
  3. Выберите: ~/.scrapper/extension/firefox/manifest.json

⚠️ Firefox захватывает куки, заголовки, localStorage — но не тела запросов на уровне CDP.


🔧 Использование захваченных данных в ваших инструментах

Python + curl_cffi (рекомендуется)

root@kitploit:~
from curl_cffi import requests

API = "http://localhost:8080"
domain = "example.com"

cookies_raw = requests.get(f"{API}/api/v1/session/cookies?domain={domain}").json()
fp = requests.get(f"{API}/api/v1/fingerprint?domain={domain}").json()

session = requests.Session(impersonate="chrome120")
for c in cookies_raw:
    session.cookies.set(c["name"], c["value"], domain=c.get("domain", domain).lstrip("."))
session.headers.update({"User-Agent": fp.get("userAgent", "")})

response = session.get(f"https://{domain}/api/data")
print(response.json())

Python requests

root@kitploit:~
import requests

session_data = requests.get('http://localhost:8080/api/v1/session/all').json()

s = requests.Session()
s.cookies.update({c['name']: c['value'] for c in session_data['cookies']})
s.headers.update({'User-Agent': session_data['fingerprint']['userAgent']})

response = s.get('https://api.example.com/data')

curl

root@kitploit:~
source <(curl -s http://localhost:8080/api/v1/export/env)

curl -X POST "https://api.example.com/upload" \
  -H "Authorization: Bearer $SCRAPPER_BEARER_TOKEN" \
  -b "$SCRAPPER_COOKIES" \
  -F "[email protected]"

Playwright (Python)

root@kitploit:~
import requests
from playwright.async_api import async_playwright

session = requests.get('http://localhost:8080/api/v1/session/all').json()

async with async_playwright() as p:
    context = await p.chromium.launch_persistent_context(
        user_data_dir="./profile",
        user_agent=session['fingerprint']['userAgent'],
    )
    await context.add_cookies(session['cookies'])
    page = await context.new_page()
    await page.goto('https://example.com')

Puppeteer (Node.js)

root@kitploit:~
const session = await fetch('http://localhost:8080/api/v1/session/all').then(r => r.json());

const browser = await puppeteer.launch();
const page = await browser.newPage();
await page.setCookie(...session.cookies);
await page.setUserAgent(session.fingerprint.userAgent);
await page.goto('https://example.com/dashboard');

📊 Обзор панели управления

SCRAPPER Live Dashboard

Откройте http://localhost:8080:


⚠️ Реалистичные ожидания

Что SCRAPPER МОЖЕТ

  • ✅ Захватывать ваши РЕАЛЬНЫЕ куки, токены и отпечаток
  • ✅ Сохранять их для повторного использования (от дней до месяцев, в зависимости от сайта)
  • ✅ Экспортировать в форматах JSON, JSONL, HAR, CSV, TXT
  • ✅ Отдавать всё через чистый локальный REST API
  • ✅ Помогать понять, как сайты действительно работают на сетевом уровне

Что SCRAPPER НЕ МОЖЕТ

  • ❌ Скрапить веб-сайты автоматически, пока вы сначала не просмотрите их
  • ❌ Угадывать, как выглядят куки или токены
  • ❌ Продлевать срок жизни куки сверх того, что разрешено сайтом
  • ❌ Работать без запущенных native host и расширения

🏭 Использование в production и автоматизация

root@kitploit:~
# Экспорт последних данных сессии
curl -s "http://localhost:8080/api/v1/bulk/all?format=jsonl" > session.jsonl

# Использование в вашем скрапере
python3 my-scraper.py --session session.jsonl
root@kitploit:~
# session_refresh.py — Еженедельный конвейер обновления сессий
import requests, schedule, time

def refresh_session():
    notify_user("Пожалуйста, войдите на целевые сайты в вашем браузере")
    time.sleep(300)  # 5 минут для просмотра пользователем
    data = requests.get('http://localhost:8080/api/v1/bulk/all?format=json').json()
    with open(f'session_{int(time.time())}.json', 'w') as f:
        import json; json.dump(data, f)

schedule.every().monday.at("09:00").do(refresh_session)
while True:
    schedule.run_pending()
    time.sleep(60)

🛠️ Статус реализации

Текущая версия (v2.1.0)

  • ✅ Захват запросов/ответов/тел (Brave/Chrome через CDP)
  • ✅ Отслеживание куков (все браузеры)
  • ✅ DOM-снимки и тестирование селекторов
  • ✅ Извлечение Bearer-токенов и токенов задач
  • ✅ Захват отпечатка браузера
  • ✅ Поток событий в реальном времени (SSE)
  • ✅ Пакетный экспорт (JSON/JSONL/TXT/HAR/CSV)
  • ✅ Очередь URL с задержками, имитирующими человеческое поведение
  • ✅ «Копировать для LLM» для каждого запроса и конечной точки
  • ✅ Расширения для Brave, Chrome, Edge, Firefox
  • ✅ Установщики Linux + Windows

Скоро

  • 🔜 Публикация в Chrome Web Store
  • 🔜 Публикация в Firefox Add-ons (подписанное)
  • 🔜 Захват WebSocket-фреймов
  • 🔜 Обмен сессиями между машинами

🤝 Вклад в проект

Открыть issue


🙏 Создано с помощью

  • BertUI React Framework — UI панели управления
  • Bun + ElysiaJS — Быстрый JavaScript-рантайм
  • Rust + scraper crate — Сверхбыстрый движок CSS-селекторов
  • C — Хост native messaging с ультранизкой задержкой (Linux)
  • C + WinAPI — Хост native messaging (Windows named pipes)
  • Python 3 — REST API-сервер без зависимостей

SCRAPPER by BertUI — Наблюдатель сессий для веб-автоматизации
🔍 Следит за вашим браузером, чтобы вам не пришлось этого делать

⭐ Поставьте звезду репозиторию, если SCRAPPER помог вам — это поможет другим найти его!

Скачать инструмент
SCRAPPER — Скрепите веб простым способом | Kitploit
ПроблемаПочему это сложно
АутентификацияРучное написание скриптов входа для каждого сайта — утомительно и ненадёжно
Состояние сессииКуки истекают, токены ротируются, localStorage очищается
Обратная разработкаЧасы, проведённые в DevTools за изучением API-паттернов
Обнаружение ботовTLS-отпечатки, энтропия браузера, Cloudflare, hCaptcha
Сложность настройкиБорьба с headless-браузерами, прокси и stealth-плагинами
SCRAPPER — ЭТО...SCRAPPER — НЕ...
🔍 Наблюдатель сессий, который следит за ВАШИМ реальным браузером❌ Замена Puppeteer/Playwright/Selenium
💾 Инструмент захвата данных, сохраняющий вашу реальную сессию❌ Инструмент, который самостоятельно парсит сайты
📡 Локальный API-сервер, отдающий захваченные данные❌ Хостинг-сервис или облачная платформа
🧠 Помощник обратной разработки, раскрывающий скрытые API❌ Волшебная кнопка «спарсить всё»
🎯 Визуальный отладчик для понимания структуры сайта❌ Конструктор автоматизации без кода
ПреимуществоПочему это важно
Обход продвинутого обнаружения ботовИспользует curl_cffi, чтобы имитировать TLS-отпечаток реального браузера (например, Chrome 120) — не помечается как автоматизированный
97% успехаНацелен на внутренние API-маршруты, а не на визуальный интерфейс — устойчив к изменениям CSS, перемещающимся кнопкам или изменению макета
Низкое потребление ресурсов~20 МБ ОЗУ против 500+ МБ у Puppeteer/Selenium. Не запускает движок браузера
Невидимая аутентификацияИспользует вашу существующую сессию, подтверждённую человеком — никакого процесса входа, никаких CAPTCHA
Синхронизация с реальным браузеромСообщения/действия из скриптов отображаются на реальной вкладке браузера после обновления
Языковая независимостьAPI сессии работает с Python, Go, Rust, Node, curl — с чем угодно, что может делать HTTP-запросы
НедостатокЧто это означает
Хрупкая продолжительность сессииПолностью зависит от активной сессии браузера — завершается, если вы выйдете
Зависимость от внутренних APIИспользует недокументированные конечные точки, которые могут измениться без предупреждения
Требует инфраструктуры установкиНе самостоятелен — необходимо одновременное выполнение native host + расширение браузера
Риск для учётной записиИспользует вашу реальную личность. Агрессивное ограничение частоты запросов может привести к блокировке настоящей учётной записи
Порог входаНеобходимо читать сетевой трафик, чтобы понять правильные полезные нагрузки API
Привязка к одному устройствуdevice-id привязан к одной захваченной сессии — нельзя легко перенести на другую машину
Конечная точкаОписание
GET /api/v1/session/cookies?domain=example.comВсе куки для домена
GET /api/v1/session/localstorage?domain=example.comДанные localStorage
GET /api/v1/session/allПолный дамп сессии
GET /api/v1/fingerprintОтпечаток браузера
GET /api/v1/tokens/allВсе извлечённые токены
GET /api/v1/requests/recent?limit=50Недавние сетевые запросы
GET /api/v1/dom/snapshot?url=example.comDOM-снимок
GET /api/v1/export/envФормат переменных окружения
GET /api/v1/bulk/all?format=[json|jsonl|har|csv|txt]Всё в нужном формате
ВкладкаЧто она делает
LiveПоток всех захваченных сетевых событий в реальном времени
BodiesТела HTTP-ответов — JSON, HTML, SVG, изображения, с предпросмотром
ResponsesВсе HTTP-ответы по доменам, фильтруемые по флагам
IntelСводка по домену — токены, куки, конечные точки, DOM-карта
TokensBearer-токены, токены задач, куки аутентификации, curl-фрагменты
EndpointsВсе обнаруженные конечные точки API с кнопкой «Копировать для LLM»
DOM MapПолное дерево тегов/классов/ID — нажмите на любой элемент для авто-скрапинга
FindТестирование CSS-селекторов на реальном отрендеренном HTML
NavНавигация + отслеживание вкладок, дамп куков, захват HTML
QueueПакетная обработка списков URL с настраиваемыми задержками
ОбластьЧто нужно
ТестированиеПопробуйте SCRAPPER на разных сайтах, сообщайте об ошибках
FirefoxПомогите улучшить обходные пути для CDP в расширении Firefox
WindowsПротестируйте граничные случаи установщика Windows
ДокументацияНапишите учебные пособия для конкретных сайтов или сценариев использования
КодПринимаются PR — особенно с исправлениями ошибок