GoogleGoogle Professional Data Engineer (PDE) Certification·KO·업데이트됨 21 Aug 2026
Cloud Storage에 있는 예약 및 사용자 프로필에 대한 CSV 덤프를 받았으며, 분석가가 PII에 액세스하지 않고도 이메일을 기준으로 조인할 수 있도록 두 데이터세트의 이메일 필드를 비식별화해야 합니다. BigQuery로 로드하기 전에 무엇을 해야 할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 1. Cloud DLP에서 recordTransformations를 사용하고 비식별화 변환 유형으로 FFX를 사용한 형식 보존 암호화를 사용하여 이메일 필드를 비식별화하는 파이프라인을 생성합니다. 2. 예약 및 사용자 프로필 데이터를 BigQuery 테이블로 로드합니다..
이것이 정답인 이유
정답은 Cloud DLP의 형식 보존 암호화(FFX)를 사용하여 이메일 필드를 비식별화하는 것입니다. FFX는 원본 이메일 형식(예: example@domain.com)을 유지하면서 데이터를 비식별화하여, 비식별화된 이메일 주소를 기준으로 두 데이터세트를 정확하게 조인할 수 있게 합니다. 마스킹은 데이터를 완전히 변경하여 조인 기능을 상실하게 합니다. 동적 데이터 마스킹은 BigQuery에 로드된 데이터에 적용되며, PII에 액세스하지 않고 조인해야 하는 요구사항을 충족시키지 못합니다. 데이터 로드 전에 비식별화하는 것이 분석가가 PII에 직접 액세스하는 것을 방지하는 최선의 방법입니다.