Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
privacy-parser — Inverso do Filtro de Privacidade da OpenAI: mesmo modelo de 1.5B, retorna PII como spans estruturados em vez de mascarar. | Kitploit
Ferramentas/GitHubGitHub/chiefautism/privacy-parser
OSINT (Inteligência de Fontes Abertas)ReconhecimentoAnálise de VulnerabilidadesExfiltração de DadosColeta de InformaçõesTestes de PenetraçãoPrivacidadeAprendizado de Máquina
GitHubchiefautism/privacy-parser

privacy-parser

Inverso do Filtro de Privacidade da OpenAI: mesmo modelo de 1.5B, retorna PII como spans estruturados em vez de mascarar.

Ver Repositório
40334há 3 mesesRevisado pelo Kitploit

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar

OpenAI Privacy Parser

OpenAI lançou o Privacy Filter — um modelo que oculta PII em texto. Defensores o usam para que dados não vazem.

Mas toda defesa tem um segundo lado. Atacantes também precisam de PII. De logs, dumps, buckets S3 abandonados, caixas de entrada roubadas. Mesma tarefa: encontrar tudo que é pessoal em uma pilha de texto.

Privacy Filter mascara. Privacy Parser extrai.

Mesmo modelo, mesma taxonomia de rótulos, mesmos pesos. Em vez de <REDACTED> você obtém spans estruturados — o que, onde, qual tipo.

Defesa: audite seus dados antes que vazem. Ofensa: analise os de outra pessoa depois que vazaram.

A ferramenta não sabe de que lado está. É apenas um bom parser.


Instalar

root@kitploit:~
uv venv
uv pip install -e ./privacy-filter
uv pip install -e ./pii_parser

A primeira execução baixa o checkpoint opf 1.5B (~3 GB) para ~/.opf/privacy_filter/.

Uso

root@kitploit:~
from pii_parser.hybrid import HybridPIIParser

parser = HybridPIIParser(device="cpu")
result = parser.parse(
    "Hi Quindle Testwick ([email protected] / +1-415-555-0102), "
    "account 40702810500001234567, 14 Beautiful Ct, Anytown USA, "
    "password Priv4cy-Filt3r-2026."
)
for s in result.spans:
    print(f"{s.label:18}  {s.text}")
root@kitploit:~
private_person      Quindle Testwick
private_email       [email protected]
private_phone       +1-415-555-0102
account_number      40702810500001234567
private_address     14 Beautiful Ct, Anytown USA
secret              Priv4cy-Filt3r-2026

CLI

root@kitploit:~
python -m pii_parser.cli_model "Alice paid 40702810500001234567 on 2026-05-17."

Três backends

Hybrid = modelo + span-merge + regex de retaguarda. Use este.

Rótulos

Taxonomia opf v2 — 8 categorias:

private_person · private_email · private_phone · private_address · private_url · private_date · account_number · secret

Arquitetura

root@kitploit:~
text
  ↓
opf 1.5B → BIOES logits → Viterbi (tuned) → char spans
  ↓
span-merge (glues Quindle + Testwick)
  ↓
regex backstop (URL, secret, account — where the model misses)
  ↓
spans[]

Benchmarks

root@kitploit:~
python pii_parser/tests/test_hybrid.py
root@kitploit:~
Fixture F1:  0.929
Scenarios:   8/8 passed
Latency:     ~600 ms CPU

Licença

Apache-2.0.

Baixar ferramenta
BackendPesosVelocidadeF1
PIIParsernenhumµs1.000
ModelPIIParser1.5B500 ms CPU0.733
HybridPIIParser1.5B600 ms CPU0.929