Skip to content
KitploitKITPLOIT
StrumentiBlog
Invia
StrumentiBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

··Feed·Contatto·Privacy·© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
privacy-parser — L'inverso del filtro privacy di OpenAI: stesso modello 1.5B, restituisce i PII come intervalli strutturati invece di mascherarli. | Kitploit
Strumenti/GitHubGitHub/chiefautism/privacy-parser
OSINT (Open Source Intelligence)RicognizioneAnalisi delle VulnerabilitàEsfiltrazione DatiRaccolta InformazioniPenetration TestingPrivacyMachine Learning
GitHubchiefautism/privacy-parser

privacy-parser

L'inverso del filtro privacy di OpenAI: stesso modello 1.5B, restituisce i PII come intervalli strutturati invece di mascherarli.

Vedi Repository
403343 mesi faRevisionato da Kitploit

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
Condividi

OpenAI Privacy Parser

OpenAI ha rilasciato Privacy Filter — un modello che nasconde i PII nel testo. I difensori lo usano affinché i dati non vengano divulgati.

Ma ogni difesa ha un secondo lato. Anche gli attaccanti hanno bisogno dei PII. Dai log, dump, bucket S3 abbandonati, caselle di posta rubate. Stesso compito: trovare tutto ciò che è personale in un mucchio di testo.

Privacy Filter maschera. Privacy Parser estrae.

Stesso modello, stessa tassonomia delle etichette, stessi pesi. Invece di <REDACTED> ottieni span strutturati — cosa, dove, quale tipo.

Difesa: verifica i tuoi dati prima che vengano divulgati. Offesa: analizza quelli di qualcun altro dopo che lo sono stati.

Lo strumento non sa da che parte stare. È semplicemente un buon parser.


Installazione

root@kitploit:~
uv venv
uv pip install -e ./privacy-filter
uv pip install -e ./pii_parser

Il primo avvio scarica il checkpoint opf 1.5B (~3 GB) in ~/.opf/privacy_filter/.

Utilizzo

root@kitploit:~
from pii_parser.hybrid import HybridPIIParser

parser = HybridPIIParser(device="cpu")
result = parser.parse(
    "Hi Quindle Testwick ([email protected] / +1-415-555-0102), "
    "account 40702810500001234567, 14 Beautiful Ct, Anytown USA, "
    "password Priv4cy-Filt3r-2026."
)
for s in result.spans:
    print(f"{s.label:18}  {s.text}")
root@kitploit:~
private_person      Quindle Testwick
private_email       [email protected]
private_phone       +1-415-555-0102
account_number      40702810500001234567
private_address     14 Beautiful Ct, Anytown USA
secret              Priv4cy-Filt3r-2026

CLI

root@kitploit:~
python -m pii_parser.cli_model "Alice paid 40702810500001234567 on 2026-05-17."

Tre backend

Hybrid = modello + span-merge + regex di ripiego. Scegli questo.

Etichette

Tassonomia opf v2 — 8 categorie:

private_person · private_email · private_phone · private_address · private_url · private_date · account_number · secret

Architettura

root@kitploit:~
text
  ↓
opf 1.5B → BIOES logits → Viterbi (tuned) → char spans
  ↓
span-merge (glues Quindle + Testwick)
  ↓
regex backstop (URL, secret, account — where the model misses)
  ↓
spans[]

Benchmark

root@kitploit:~
python pii_parser/tests/test_hybrid.py
root@kitploit:~
Fixture F1:  0.929
Scenarios:   8/8 passed
Latency:     ~600 ms CPU

Licenza

Apache-2.0.

Scarica lo strumento
BackendWeightsSpeedF1
PIIParsernoneµs1.000
ModelPIIParser1.5B500 ms CPU0.733
HybridPIIParser1.5B600 ms CPU0.929