아래는 어느 병원이 연구기관에 환자 데이터를 제공하기 위해 수행한 비식별 조치 (가)~(라)이다. 이에 대한 설명으로 가장 적절하지 않은 것은?
보기
(가) 환자명 '김민준'을 'P0137'과 같은 일련번호로 대체하고, 대체 규칙을 담은 매핑표는 병원 내부 서버에 별도로 보관하였다.
(나) 생년월일 '1987-03-14'를 '1980년대 출생'으로 바꾸었다.
(다) 환자별 진료비 항목을 모두 삭제하고, 진료과별 평균 진료비만 남겼다.
(라) 주소 '서울특별시 강남구 역삼동 123-45'에서 동 이하를 삭제하여 '서울특별시 강남구'까지만 남겼다.
- 1(가)는 가명처리에 해당하며, 매핑표가 함께 유출되면 원래의 개인을 복원할 수 있으므로 매핑표의 분리 보관과 접근 통제가 반드시 병행되어야 한다.
- 2(다)는 개별 값을 집계값으로 대체하는 총계처리이므로, 특정 진료과에 해당하는 환자가 단 한 명뿐인 경우에도 그 환자의 진료비는 드러나지 않는다.
- 3(나)와 (라)는 값의 정밀도를 낮추어 개인이 특정될 가능성을 줄이는 조치로, 정밀도를 낮출수록 재식별 위험은 줄어들지만 데이터의 분석적 유용성도 함께 낮아진다.
- 4(가)~(라)를 모두 적용하였더라도 성별·연령대·거주지처럼 그 자체로는 식별자가 아닌 항목들이 함께 남아 있으면, 외부 데이터와 결합하여 특정 개인이 재식별될 수 있다.
꿈라CBT