
개발/테스트 데이터베이스에서 프로덕션에서 복사된 PII 및 유사 데이터를 대체하기 위한 익명화 도구
문서:
pgEdge Anonymizer는 PostgreSQL 데이터베이스에서 개인 식별 정보(PII)를 익명화하기 위한 명령줄 도구입니다. 이 도구는 민감한 데이터를 개발 및 테스트에 사용할 수 있는 현실적인 가짜 값으로 대체하며, 데이터 일관성과 참조 무결성을 유지합니다.
Anonymizer를 사용하면 단 세 단계로 Postgres 데이터베이스의 형태와 무결성을 유지하는 실험용 데이터 세트를 만들 수 있습니다:
pgedge-anonymizer를 빌드하고 실행하여 열을 변환합니다.pgedge-anonymizer를 실행하기 전에 pgedge-anonymizer.yaml이라는 구성 파일을 만들어야 합니다. 파일에는 다음이 포함되어야 합니다:
database 섹션schema_name.table_name.column_name 형식)을 나열하는 columns 섹션patterns 속성예:
database:
host: localhost
port: 5432
database: myapp
user: anonymizer
columns:
- column: public.users.email
pattern: EMAIL
- column: public.users.phone
pattern: US_PHONE
- column: public.users.ssn
pattern: US_SSN
구성 파일을 만든 후 anonymizer를 실행합니다:
pgedge-anonymizer run
pgedge-anonymizer가 실행되면서 통계를 표시하며 변경 목록을 검토합니다:
Processing public.users.email (est. 50000 rows)...
10000 rows processed
20000 rows processed
30000 rows processed
40000 rows processed
50000 rows processed
Completed: 50000 rows, 48234 values anonymized
=== Anonymization Statistics ===
Total columns processed: 1
Total rows processed: 50000
Total values anonymized: 48234
Total duration: 2.34s
Throughput: 21367 rows/sec
필수 구성 요소
다음 명령어를 사용하여 pgedge-anonymizer를 빌드합니다:
make build # 바이너리 빌드
다음 명령어를 사용하여 Anonymizer 테스트 스위트를 실행합니다:
make test
다음 명령어를 사용하여 Go Linter를 실행합니다:
make lint
다음 명령어를 사용하여 코드 형식을 지정합니다:
make fmt
이 프로젝트는 PostgreSQL 라이선스에 따라 사용이 허가됩니다.