
Ein Open-Source-Framework zur Erkennung, Schwärzung, Maskierung und Anonymisierung sensibler Daten (PII) in Text, Bildern und strukturierten Daten. Unterstützt NLP, Mustererkennung und anpassbare Pipelines.
Kontextbewusster, erweiterbarer und anpassbarer PII-De-Identifikationsdienst für Text und Bilder.
Presidio (vom Lateinischen praesidium ‚Schutz, Garnison‘) hilft sicherzustellen, dass sensible Daten ordnungsgemäß verwaltet und kontrolliert werden. Es bietet schnelle Identifikations- und Anonymisierungsmodule für private Entitäten in Texten wie Kreditkartennummern, Namen, Standorte, Sozialversicherungsnummern, Bitcoin-Wallets, US-Telefonnummern, Finanzdaten und mehr.

⚠️ Presidio kann helfen, sensible/PII-Daten in un-/strukturiertem Text zu identifizieren. Da es jedoch automatisierte Erkennungsmechanismen verwendet, gibt es keine Garantie, dass Presidio alle sensiblen Informationen findet. Folglich sollten zusätzliche Systeme und Schutzmaßnahmen eingesetzt werden.
Einzelheiten zur Mitarbeit an diesem Repository finden Sie im Leitfaden für Mitwirkende.
Dieses Projekt hat den Contributor Covenant Code of Conduct übernommen.
| Komponente | Downloads | Abdeckung |
|---|
| Presidio Analyzer | ||
| Presidio Anonymizer | ||
| Presidio Image-Redactor | ||
| Presidio Structured |