PDF에서 PII 감지 및 가리기
PDF에서 개인 데이터를 스캔하고, Auto-Redact PII로 발견된 모든 항목을 제거한 뒤, Verify Redaction으로 정말 사라졌는지 증명하세요 — 전부 여러분의 머신에서 로컬로 처리됩니다. 서식은 그대로 유지됩니다.
Detect PII는 PDF의 텍스트에서 개인 데이터를 스캔하고, Auto-Redact PII는 발견된 모든 것을 한 번에 제거하며, Verify Redaction은 결과를 다시 스캔해 추출 가능한 것이 남지 않았음을 증명합니다. 전체 과정이 로컬에서 실행됩니다 — 문서는 머신을 떠나지 않습니다.
먼저 원본을 보호하세요
Replace source는 기본적으로 켜져 있습니다. 결과가 원본 파일을 덮어쓰며 백업은 남지 않습니다. 따라 하기 전에 Settings › General을 열어 Replace source를 끄거나 별도의 출력 폴더를 지정하세요.
Detect PII
Privacy › Detect PII는 PDF 하나의 추출 가능한 텍스트를 읽고 발견한 모든 항목을 페이지별로 묶어 보고합니다 — 결과는 "N items found across M pages"로 표시됩니다. 미리보기는 마스킹되어(예: jo********@om) 스캔 출력 자체는 공유 화면에서 봐도 안전합니다.
여섯 가지 카테고리가 매칭됩니다:
| 유형 | 잡는 것 |
|---|---|
[email protected] | |
| Phone | 국제 및 국내 형식, 9–15자리 |
| Social Security number | 123-45-6789 |
| Credit card | 13–19자리, 체크섬 검증으로 임의의 숫자 나열은 플래그되지 않음 |
| IBAN | 국제 은행 계좌 번호 |
| IP address | 유효한 0.0.0.0–255.255.255.255 |
스캔은 PDF가 실제로 담고 있는 텍스트만 봅니다. 스캔 문서 — 페이지의 사진 — 에는 텍스트 레이어가 없어서 사람이 읽을 수 있어도 보고서는 비어 돌아옵니다. 그런 경우 앱이 알려 줍니다: OCR을 실행해 스캔이 무엇을 찾을지 확인하거나, Redact Content로 보이는 영역을 수동으로 가리세요.
Auto-Redact PII
Privacy › Auto-Redact PII는 스캔을 가져와 모든 항목을 한 번에 제거합니다. Pro 기능입니다.
두 가지가 이것을 위에 검은 박스를 그린 것이 아닌 진짜 가리기로 만듭니다:
- 영향받는 페이지가 래스터화됩니다 — 가리기가 칠해진 채 이미지로 렌더링 — 되어 아래 텍스트가 파일에 아예 존재하지 않게 됩니다. 사각형 아래 숨겨진 것이 아닙니다.
- 이 과정은 실패 시 닫힘: 페이지를 안전하게 렌더링할 수 없으면 겉으로만 가린 결과를 내놓는 대신 실행이 실패를 보고합니다.
트레이드오프: 래스터화된 페이지는 텍스트의 이미지가 됩니다. 표시와 인쇄는 동일하지만 그 페이지의 텍스트는 더 이상 선택하거나 검색할 수 없습니다 — PDF에서는 그것이 목적입니다.
Verify Redaction
Privacy › Verify Redaction은 출력 파일에 같은 스캔을 실행하고 여전히 추출 가능한 것을 보고합니다: 남은 텍스트 길이와 남은 PII 항목. "Clean — no extractable text remains"가 문서가 손을 떠나기 전에 원하는 결과입니다. "N items still extractable"이 나오면 스캔을 다시 실행해 무엇이 살아남았는지 보세요 — 매처가 놓친 패턴이거나 손대지 않은 페이지의 텍스트입니다.
가리기 후에는 매번 검증하세요. "검게 칠해진 것 같다"와 "증명 가능하게 사라졌다"의 차이입니다.
대신 파기해야 할 때
정리된 사본이 발송된 뒤 원본 문서가 아예 존재하지 않아야 한다면, File Shredder가 삭제 전에 원본을 무작위 데이터로 덮어씁니다 — 기본 세 번. 영구적이며 복구는 없습니다.
관련 항목
- 사진과 PDF에서 메타데이터 제거
- 개인정보와 네트워크 동작
- Redact Content 도구 — 수동 영역 가리기
- OCR 도구 — 텍스트 레이어가 없는 스캔 문서용
- 메타데이터 위생 가이드