
ドキュメント:
pgEdge Anonymizer は、PostgreSQLデータベースにおける個人識別情報(PII)を匿名化するためのコマンドラインツールです。このツールは、機密データを現実的なダミー値に置き換え、開発やテストに使用できるようにしながら、データの一貫性と参照整合性を維持します。
Anonymizer を使用すると、Postgresデータベースの形状と整合性を維持した実験用データセットをわずか3ステップで作成できます。
pgedge-anonymizer をビルドして実行し、カラムを変換します。pgedge-anonymizer を実行する前に、pgedge-anonymizer.yaml という名前の設定ファイルを作成する必要があります。ファイルには以下を含める必要があります。
databaseセクションschema_name.table_name.column_name 形式)をリストしたcolumnsセクションpatternsプロパティ例:
database:
host: localhost
port: 5432
database: myapp
user: anonymizer
columns:
- column: public.users.email
pattern: EMAIL
- column: public.users.phone
pattern: US_PHONE
- column: public.users.ssn
pattern: US_SSN
設定ファイルを作成したら、匿名化ツールを実行します。
pgedge-anonymizer run
pgedge-anonymizer の実行中に変更リストを確認し、統計を表示します。
Processing public.users.email (est. 50000 rows)...
10000 rows processed
20000 rows processed
30000 rows processed
40000 rows processed
50000 rows processed
Completed: 50000 rows, 48234 values anonymized
=== Anonymization Statistics ===
Total columns processed: 1
Total rows processed: 50000
Total values anonymized: 48234
Total duration: 2.34s
Throughput: 21367 rows/sec
前提条件
以下のコマンドを使用して pgedge-anonymizer をビルドします。
make build # Build binary
以下のコマンドを使用して Anonymizer テストスイートを実行します。
make test
以下のコマンドを使用して Go Linter を実行します。
make lint
以下のコマンドを使用してコードをフォーマットします。
make fmt
このプロジェクトはPostgreSQLライセンスの下でライセンスされています。