사전 목록
De-identification

비식별화

비식별화는 데이터에서 개인을 알아볼 수 있는 요소를 제거하거나 변형해 식별 위험을 낮추는 여러 기법과 절차를 포괄하는 표현입니다.

#개인정보 보호 기술#비식별화#식별자 제거#데이터 보호

비식별화

비식별화가명처리익명화, 집계, 마스킹, 토큰화 등 다양한 결과를 포함할 수 있습니다. 법적 상태는 처리 후의 식별 가능성과 추가정보 보유 여부로 판단합니다.

핵심 정보

분류개인정보 보호 기술

핵심 질문이 개념이 어떤 데이터·시스템·업무에 적용되며 실패할 때 누구에게 어떤 피해가 생기는지 확인합니다.

판단 원칙실제 구현, 권한, 데이터 흐름, 로그와 예외 절차를 함께 평가합니다.

작동 원리

데이터 목적과 공유 환경을 정한 뒤 직접 식별자, 준식별자, 민감속성, 자유서술 필드를 분류합니다. 적절한 변환을 적용하고 유용성과 재식별 위험을 반복 평가합니다.

운영 효과는 데이터 생성 지점, 처리 목적, 사용자와 관리자 권한, 외부 연동, 백업과 로그, 삭제 절차를 연결할 때 확보됩니다. 설계 문서와 실제 운영 상태가 다를 수 있으므로 설정값, 표본 데이터, 접근기록, 변경 이력을 근거로 검증합니다.

보호 효과와 한계

자유서술, 이미지, 음성, 시간정보에 남은 식별 단서가 누락되기 쉽습니다. 비식별 자료라는 표시만 믿고 공개하면 외부 자료와 결합해 개인이 드러날 수 있습니다.

개인정보 관련 위험에는 기밀성 침해, 잘못된 수정과 삭제, 서비스 중단, 부정확한 프로파일링, 차별적 의사결정, 계정 탈취, 사칭과 2차 피싱이 포함됩니다. 위험 평가는 정보의 민감도, 변경 가능성, 결합 가능성, 노출 기간, 대상 인원, 공격자의 실제 접근 능력을 반영합니다.

도입 전 확인할 사항

처리 전후 필드, 변환 규칙, 추가정보, 공개 범위, 위험 측정 결과를 확인합니다. 데이터 유형별로 텍스트·영상·위치·시계열의 숨은 식별성을 별도 검토합니다.

검토 결과에는 적용 범위, 남은 위험, 책임자, 개선 기한, 재검증 조건을 기록합니다. 외부 서비스와 오픈소스 구성요소가 관련되면 계약서와 보안 공지, 버전, 데이터 처리 위치, 하위 수탁·의존 관계도 확인합니다.

안전한 적용 방법

보호조치는 예방, 탐지, 대응, 복구 단계에 나누어 배치합니다. 한 통제가 우회되거나 오작동해도 피해가 곧바로 전체 데이터로 확산되지 않도록 권한·네트워크·데이터·로그 통제를 겹쳐 적용합니다.

혼동하기 쉬운 개념

비식별화는 법률상 하나의 고정된 상태를 뜻하지 않을 수 있습니다. 가명정보인지 익명정보인지에 따라 적용 의무와 허용 범위가 달라집니다.

공식 참고자료

NIST SP 800-188 — De-Identifying Government Datasets

개인정보 포털 — 개인정보의 개념