Skip to content
KitploitKITPLOIT
ToolsBlog
Einreichen
ToolsBlog
Einreichen

Hacking-, PenTest- und Cybersicherheits-Tools für Ihr Sicherheitsarsenal!

Kitploit ist ein Verzeichnis von Hacking-, Cybersicherheits- und Pentesting-Tools. Entdecken Sie die neuesten Projekt-Updates, um Schwachstellen zu finden, Systeme zu analysieren, Tests zu automatisieren und Ihre Sicherheit zu stärken.

··Feeds·Kontakt·Datenschutz·© 2026 Kitploit

Tool-Verzeichnis

Kategorien

Alle Kategorien anzeigen
Loading categories
privacy-parser — Umkehrung des OpenAI Privacy Filters: gleiches 1.5B-Modell, gibt PII als strukturierte Spans anstatt Maskierung zurück. | Kitploit
Tools/GitHubGitHub/chiefautism/privacy-parser
OSINT (Open-Source-Intelligence)AufklärungSchwachstellenanalyseDatenexfiltrationInformationsbeschaffungPenetrationstestsPrivatsphäreMaschinelles Lernen
GitHubchiefautism/privacy-parser

privacy-parser

Umkehrung des OpenAI Privacy Filters: gleiches 1.5B-Modell, gibt PII als strukturierte Spans anstatt Maskierung zurück.

Repository anzeigen
40334vor 3 MonatenVon Kitploit geprüft

Beliebteste

Alle anzeigen →

Entdecken Sie die meistgenutzten Tools unserer Community.

Alle Tools erkunden

Durchsuchen Sie unsere Tool-Sammlung

Alle Tools anzeigen →
Teilen

OpenAI Privacy Parser

OpenAI hat Privacy Filter veröffentlicht – ein Modell, das PII in Text versteckt. Verteidiger nutzen es, damit keine Daten auslaufen.

Aber jede Verteidigung hat eine zweite Seite. Auch Angreifer brauchen PII. Aus Logs, Dumps, verlassenen S3-Buckets, gestohlenen Posteingängen. Gleiche Aufgabe: alles Persönliche in einem Texthaufen finden.

Privacy Filter maskiert. Privacy Parser extrahiert.

Gleiches Modell, gleiche Label-Taxonomie, gleiche Gewichte. Statt <REDACTED> erhältst du strukturierte Spannen – was, wo, welcher Typ.

Verteidigung: Prüfe deine Daten, bevor sie auslaufen. Angriff: Analysiere die Daten anderer, nachdem sie ausgelaufen sind.

Das Tool weiß nicht, auf welcher Seite es steht. Es ist einfach ein guter Parser.


Installation

root@kitploit:~
uv venv
uv pip install -e ./privacy-filter
uv pip install -e ./pii_parser

Der erste Lauf lädt den opf 1.5B Checkpoint (~3 GB) nach ~/.opf/privacy_filter/ herunter.

Verwendung

root@kitploit:~
from pii_parser.hybrid import HybridPIIParser

parser = HybridPIIParser(device="cpu")
result = parser.parse(
    "Hi Quindle Testwick ([email protected] / +1-415-555-0102), "
    "account 40702810500001234567, 14 Beautiful Ct, Anytown USA, "
    "password Priv4cy-Filt3r-2026."
)
for s in result.spans:
    print(f"{s.label:18}  {s.text}")
root@kitploit:~
private_person      Quindle Testwick
private_email       [email protected]
private_phone       +1-415-555-0102
account_number      40702810500001234567
private_address     14 Beautiful Ct, Anytown USA
secret              Priv4cy-Filt3r-2026

CLI

root@kitploit:~
python -m pii_parser.cli_model "Alice paid 40702810500001234567 on 2026-05-17."

Drei Backends

Hybrid = Modell + Spannen-Zusammenführung + Regex-Absicherung. Verwende diesen.

Labels

opf v2 Taxonomie – 8 Kategorien:

private_person · private_email · private_phone · private_address · private_url · private_date · account_number · secret

Architektur

root@kitploit:~
text
  ↓
opf 1.5B → BIOES logits → Viterbi (tuned) → char spans
  ↓
span-merge (glues Quindle + Testwick)
  ↓
regex backstop (URL, secret, account — where the model misses)
  ↓
spans[]

Benchmarks

root@kitploit:~
python pii_parser/tests/test_hybrid.py
root@kitploit:~
Fixture F1:  0.929
Szenarien:   8/8 bestanden
Latenz:      ~600 ms CPU

Lizenz

Apache-2.0.

Tool herunterladen
BackendGewichteGeschwindigkeitF1
PIIParsernoneµs1.000
ModelPIIParser1.5B500 ms CPU0.733
HybridPIIParser1.5B600 ms CPU0.929